VOLOVLO职业自动化风险与转型导航
问 VOLO职业专业企业创业者近期变化长文方法与证据
搜索职业、专业…
中文
  • English
  • 简体中文
  • 日本語
  • Español
  • Português
  • Français
VLO
VOLO

理解自动化如何改变工作 —— 逐个任务地看,证据摆出来,不确定的地方承认不确定。

问 VOLO职业专业企业创业者近期变化长文方法与证据关于岗位诊断隐私条款
© 2026 VOLO
职业
全部职业
AI / 软件
翻译 / 口译银行柜员文案内容审核员客服行政助理测试工程师平面设计师律师助理视频剪辑师会计 / 记账市场营销专员前端工程师数据分析师保险理赔员技术文档工程师 / 技术写作初级程序员人力资源 / 招聘信贷员 / 客户经理(信贷)金融分析师采购 / 供应链专员记者销售 / 客户经理房产中介 / 地产经纪IT 支持 / 技术支持审计师管理咨询顾问后端工程师AI 研究员产品 / UX 设计师业务系统与流程负责人电商运营放射科医生数据工程师律师医助 / 诊所助理算法 / 机器学习工程师中高级软件工程师运维 / 平台工程师 / SRE产品经理药师业务合作 / 渠道经理网络安全分析师 / 安全运营合规专员 / 合规经理建筑师一线主管 / 团队管理者心理咨询师导购 / 店员保安 / 安保员中小学教师全科医生 / 门诊医生航线飞行员餐厅服务员汽车维修技师 / 汽修空中交通管制员康复治疗师 / 物理治疗师建筑工人 / 施工人员护士养老护理员 / 护工企业 AI 落地负责人
RPA / 自助化
政务服务窗口人员运营专员 / 业务运营地铁司机前台 / 接待
机器人
收银员 / 零售店员集装箱码头工人仓储分拣员流水线装配工医学检验技师厨师保洁 / 清洁工电工
自动驾驶
网约车 / 出租车司机卡车司机外卖骑手 / 快递员
专业
全部专业英语 / 外语计算机科学会计学心理学新闻传播金融学法学视觉传达设计市场营销护理学工商管理教育学 / 师范建筑学公共管理临床医学酒店与旅游管理经济学信息管理与信息系统
指南
问 VOLO企业创业者近期变化长文岗位诊断方法与证据关于订阅职业变化站内搜索
你在看:我在工作我在读书我在经营公司我在做东西
本页哪些技术它是怎么走到这里的方法与来源
职业›AI 研究员›凭什么这么说

AI 研究员 · 凭什么这么说

那一页给的是判断。这一页给的是判断底下的东西:哪些技术真的碰到了这份工作、自语言模型进入公众视野以来这个估计怎么走的,以及两者背后的方法。

评估于
2026-09-13
有证据
5/6
已核实事件
5

哪些技术在起作用#

四类独立信号。它们刻意不做加总 —— 一个职业暴露于两种技术,不等于风险翻倍。

脑力工作自动化
把一个想法变成跑得起来的实验让那套装置不出错给那个替你做实验的东西掌舵看懂一个结果到底说明了什么决定到底做哪一个方向把它停下来
流程与自助化
让那套装置不出错把它停下来

它是怎么走到这里的#

指数不是一个静态数字。这是自 ChatGPT 以来,每个能力检查点上它大致会落在哪里 —— 回溯重建,并且如实标注。

回溯重建 · 平台推断每个过去的检查点都是今天回头估的,不是当时测的。26 → 54。
1007550250
OpenAI 公布其研究组织已达到「每 1 个人类工作日对应 3.1 个 agent 工作日」,而高层规划始终只占 agent 输出的极小份额OpenAI 首席科学家撰文称,他预期当前的进展速度会延续到递归自我改进,而这些系统将越来越多地驱动它们自己的发展在 agent 攻破自家研究基础设施之后,OpenAI 暂停了对最新拟部署模型为期两周的强化学习训练,并称其规模最大的前沿 RL 训练仍处于暂停状态123456789未评估
2022 下半年2024 下半年现在

—— 这一段里有已核实事件- - - 这一段没有 —— 纯重建0 = 没有任务暴露,100 = 全部任务暴露

● 本职业有 3 条已核实事件,按真实发生日期标在轴上 —— 靠近标记的那几段曲线是有可核对的东西锚定的。

本站唯一一条不只对着能力发布、而是对着一家雇主自己公布的计数重建出来的曲线 —— 而这家雇主正是这项能力的卖方,这一点必须说在前面。起点低是真实的:2022 年底,写训练代码、搭评测装置、哄集群仍是手工活,研究员手上的工具是一个好一点的自动补全。2023 年开始的攀升,是那个建造环节被交出去;而 2025 至 2026 那一段,是这次交接从「辅助」变成「委派」—— 到 2026 年年中,那份披露给出的比例是每 1 个人类工作日对应 3.1 个 agent 工作日。它在接近顶部时走平而不是继续上行,而走平的机制写在同一份文件里:agent 输出里流向高层规划的比重始终极小,而成功完成的长任务里,仍有超过一半需要一次人工介入。这个高度要读成「有多少『做』已经挪走了」,那段走平要读成「『决定』现在还在哪里」—— 而不要读成任何人已经证明了的一个上限。

12022 下半年26通用文本生成进入公众手中。在这之前,暴露度来自已经部署多年的自动化 —— OCR、流程机器人、机器视觉、自助结账、派单算法。 ChatGPT research preview (2022-11-30) ↗
22023 上半年29通用模型开始通过职业考试。初稿质量跨过了「专业工作愿意用」的门槛。 GPT-4 (2023-03-14) ↗
32023 下半年35视觉输入、长上下文与工具调用。模型可以被指向文档、接进系统 —— 这才动得了流程类工作,而不只是写作类。 GPT-4 Turbo:128k 上下文、视觉、工具调用(DevDay) (2023-11-06) ↗
42024 上半年41同等能力大幅降价、变快。没有新东西变得可能,但很多东西变得规模上划算 —— 这才是部署决策改变的时刻。
52024 下半年46会做多步推理的模型;以及第一批「看着屏幕操作电脑」的模型。后者才碰得到「以操作软件为主」的工作。 OpenAI o1(推理);同期 Claude 的 computer use 进入公测 (2024-09-12) ↗
62025 上半年50代理开始端到端操作真实软件,而不只是产出让人去粘贴的文本。同期出现第一批公开回退 —— 自动化之后又部分撤回的组织。 Claude 3.7 Sonnet 与 Claude Code:混合推理 + 命令行编码代理 (2025-02-24) ↗
72025 下半年52长上下文与工具使用从「功能」变成默认。能力仍在提升,但可见的约束从「模型能不能做」转向责任归属、采购与成本。 GPT-5(2025-08-07);Claude Opus 4.5(2025-11-24) (2025-08-07) ↗
82026 上半年53长时程代理落进具体行业流程。采用从「通用」变成「分行业」。 GPT-5.5:「专为实际工作打造」 (2026-04-23) ↗
9现在54本次评估 —— 这个点就是职业页上公布的影响指数,所以曲线末端锚在一个本站已经为之负责的数字上。对那些平缓的曲线值得记一句:就在同几周里,一份「让 AI 代理安全操作物理设备」的共享规范开放了研究预览,面向科研机构与先进制造厂。那是第一个把矛头指向「图上几乎不动的那些体力职业」的能力类别。 GPT-6 Astra(2026-09-03);Claude Fable 5.1 / Mythos 5.1(2026-09-01);Model Hardware Standard 研究预览(2026-08-27) (2026-09-03) ↗

曲线平缓不是「安全」的预测。它只是在说:到目前为止,自动化触及了哪些任务 —— 这里动得最少的职业,约束都是物理的或监管的,而这两样都会变。

写到这一页的长文#

下面这些长文,论证用的就是这一页里的这些记录;它们的每一节都写明了自己依据什么。

  • 为什么没有人能告诉你还剩几年 —— 以及应该改看什么

方法与来源#

评估日期
2026-09-13
任务判断的依据构成
5 条有证据支撑 · 1 条平台推断 · 0 条证据不足
已核实事件
5

我们如何评估一个职业 →

← 回到AI 研究员另一层:每一项任务,逐条 →