心理学家 · 凭什么这么说
那一页给的是判断。这一页给的是判断底下的东西:哪些技术真的碰到了这份工作、自语言模型进入公众视野以来这个估计怎么走的,以及两者背后的方法。
哪些技术在起作用#
四类独立信号。它们刻意不做加总 —— 一个职业暴露于两种技术,不等于风险翻倍。
脑力工作自动化
施测标准化测验撰写评估报告初筛与诊断心理治疗记录、信函与文书
流程与自助化
记录、信函与文书
它是怎么走到这里的#
指数不是一个静态数字。这是自 ChatGPT 以来,每个能力检查点上它大致会落在哪里 —— 回溯重建,并且如实标注。
回溯重建 · 平台推断每个过去的检查点都是今天回头估的,不是当时测的。20 → 38。
Pearson 在其 Q-global 和 Q-interactive 测验平台中推出 AI 助手,起草心理评估报告的叙述部分,并称临床人员仍负全部责任一项研究发现:在澳大利亚,43.5% 的受访心理健康从业者每天用 AI 做行政或临床辅助工作,33.1% 每天用于面向来访者的工作心理学家就业在 2025 至 2035 年增长 6%,临床与咨询心理学家增长 12%,美国劳工统计局预测,且未提及 AI澳大利亚心理学会表示:心理学家使用 AI 时对所有结果负全部责任,每一种具体工具都需要明确同意过半数美国心理学家过去一年至少用过一次 AI 工具,2024 年为 29%,主要用于邮件和记录,美国心理学会公布伊利诺伊州监管机构宣布:该州法律禁止任何人用 AI 提供治疗性决策,只允许其用于行政与辅助支持NICE 表示:两种 AI「数字前门」工具可以为 NHS 谈话治疗的评估收集信息,但只限于为期三年的证据收集期一项由 249 名评分者参与的研究发现:持证心理学家对人写的心理报告的评价总体高于 GPT-4 写的,但效应量通常很小日本《公認心理師法》要求公认心理师在受支援者有主治医师时接受其指示,但只保护名称,不保留业务本身一项研究发现:在治疗情境测试中,语言模型对有心理健康问题的人表现出污名化,并助长来访者的妄想在第一项生成式 AI 治疗聊天机器人的临床试验中,抑郁症状平均减轻 51%,但研究者表示还没有 AI 能完全自主运作在一项覆盖 129,400 名患者、由聊天机器人厂商进行的研究中,使用 AI 自助转介聊天机器人的 NHS 谈话治疗服务转介增加 15%,对照服务为 6%未评估
2022 下半年2024 下半年现在
—— 这一段里有已核实事件- - - 这一段没有 —— 纯重建0 = 没有任务暴露,100 = 全部任务暴露
● 本职业有 12 条已核实事件,按真实发生日期标在轴上 —— 靠近标记的那几段曲线是有可核对的东西锚定的。
起点是 20,因为在这张图开始之前,计算机化的测验计分和电子病历已是常规,而施测、诊断和治疗都是当面进行的。随着能起草记录、摘要和评估报告的发布,它逐步上升 —— 调查显示心理学家把它们用在文书上;它停在低位,是因为诊断和治疗仍在心理学家手里,一项试验的研究者自己说 AI 还不能自主运作,美国一个州也禁止 AI 做治疗性决策。
12022 下半年20通用文本生成进入公众手中。在这之前,暴露度来自已经部署多年的自动化 —— OCR、流程机器人、机器视觉、自助结账、派单算法。 ChatGPT research preview (2022-11-30) ↗
32023 下半年23视觉输入、长上下文与工具调用。模型可以被指向文档、接进系统 —— 这才动得了流程类工作,而不只是写作类。 GPT-4 Turbo:128k 上下文、视觉、工具调用(DevDay) (2023-11-06) ↗
42024 上半年26同等能力大幅降价、变快。没有新东西变得可能,但很多东西变得规模上划算 —— 这才是部署决策改变的时刻。
52024 下半年29会做多步推理的模型;以及第一批「看着屏幕操作电脑」的模型。后者才碰得到「以操作软件为主」的工作。 OpenAI o1(推理);同期 Claude 的 computer use 进入公测 (2024-09-12) ↗
62025 上半年32代理开始端到端操作真实软件,而不只是产出让人去粘贴的文本。同期出现第一批公开回退 —— 自动化之后又部分撤回的组织。 Claude 3.7 Sonnet 与 Claude Code:混合推理 + 命令行编码代理 (2025-02-24) ↗
72025 下半年34长上下文与工具使用从「功能」变成默认。能力仍在提升,但可见的约束从「模型能不能做」转向责任归属、采购与成本。 GPT-5(2025-08-07);Claude Opus 4.5(2025-11-24) (2025-08-07) ↗
9现在38本次评估 —— 这个点就是职业页上公布的影响指数,所以曲线末端锚在一个本站已经为之负责的数字上。对那些平缓的曲线值得记一句:就在同几周里,一份「让 AI 代理安全操作物理设备」的共享规范开放了研究预览,面向科研机构与先进制造厂。那是第一个把矛头指向「图上几乎不动的那些体力职业」的能力类别。 GPT-6 Astra(2026-09-03);Claude Fable 5.1 / Mythos 5.1(2026-09-01);Model Hardware Standard 研究预览(2026-08-27) (2026-09-03) ↗
曲线平缓不是「安全」的预测。它只是在说:到目前为止,自动化触及了哪些任务 —— 这里动得最少的职业,约束都是物理的或监管的,而这两样都会变。
写到这一页的长文#
下面这些长文,论证用的就是这一页里的这些记录;它们的每一节都写明了自己依据什么。
方法与来源#
- 评估日期
- 2026-09-30
- 任务判断的依据构成
- 4 条有证据支撑 · 1 条平台推断 · 0 条证据不足
- 已核实事件
- 12