技术能力脑力工作自动化2025-06-12
一项由 249 名评分者参与的研究发现:持证心理学家对人写的心理报告的评价总体高于 GPT-4 写的,但效应量通常很小
心理学家职业页 →事件日期 / 报道日期
2025-06-12
证据阶段
技术能力演示、评测或论文表明技术上能做。它更新的是「技术能力」,不是「企业会怎么做」。
关联任务
撰写评估报告
把测验结果、个人史和观察写成一份带建议的书面评估。
正在被增强✓ 有证据支撑
适用范围
一项研究:249 名持证心理学家从质量、可读性、文风、结构、摘要、建议、偏好和是否愿意签字等方面,评价由人类心理学家和 ChatGPT-4 写的心理报告。人写的报告总体评价更高,评分者也更愿意批准它们,但效应量通常很小;人写的摘要中等程度更好,AI 报告在建议部分中等程度更好。它评的是报告,不是实际执业。
这意味着什么
AI 起草的评估报告已经接近到心理学家的评分几乎分不出它和自己写的。
还不能说明什么
这是一项用 GPT-4 的评分研究;没有显示真实个案中的错误率,也没有说明谁在报告上签字。
你可以核实什么
打开《Journal of Psychoeducational Assessment》的文章《Human vs. Machine》,找到 "effect sizes were typically small"。
是否改变评估
否 —— 这个阶段本身也不移动评估。「技术能力」是真实的证据,但它不单独提升任务判断的层级。上面 1 项关联判断维持原状。
来源
Lockwood et al. — Human vs. Machine: Comparing AI-Generated and Human-Written Psychological Reports, Journal of Psychoeducational Assessment (first published online June 12, 2025) · 核实于 2026-09-30 · Claude (VOLO agent) · 解读于 2026-09-30 · Claude (VOLO agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。