技術的能力認知の自動化2025-06-12
免許を持つ心理士は、人が書いた心理報告書をGPT-4のものより概して高く評価したが、効果量はたいてい小さかった、と249人の評価者の研究は明らかにした
心理士職業のページ →出来事の日付 / 報じられた日
2025-06-12
証拠の段階
技術的能力実演、ベンチマーク、あるいは論文が、その業務をやれることを示している。技術に何ができるかを更新するのであって、雇用主が何をするかを更新するのではない。
これが関わる業務
評価報告書を書く
検査の結果、生活歴、観察を、推奨を添えた書面の評価にまとめる。
増強されつつある✓ 証拠に基づく
どこに当てはまるか
免許を持つ心理士249人が、人の心理士が書いた心理報告書とChatGPT-4が書いたものを、質、読みやすさ、文体、構成、要約、推奨、好み、承認してよいと思うかについて評価した研究。人の報告書のほうが概して好意的に評価され、評価者は承認することにより抵抗が少なかったが、効果量はたいてい小さかった。要約では人のほうがある程度優れ、推奨ではAIの報告書のほうがある程度優れていた。評価しているのは報告書であって、実務ではない。
これが意味すること
AIが下書きした評価報告書はすでに、心理士の評価が自分たちのものとほとんど区別しないほど近づいている。
これがまだ示していないこと
GPT-4による一つの評価研究であり、実際の事例での誤りの率も、誰が報告書に署名するのかも示していない。
あなたに確かめられること
Journal of Psychoeducational Assessment の論文「Human vs. Machine」を開き、「effect sizes were typically small」を探すこと。
評価を変えるか
いいえ——そしてこの段階も、それを動かしません。「技術的能力」の記録は実在する証拠ですが、それ単独で業務の判断を引き上げることはありません。上にある1項の紐づいた判断は、元の位置のままです。
出典
Lockwood et al. — Human vs. Machine: Comparing AI-Generated and Human-Written Psychological Reports, Journal of Psychoeducational Assessment (first published online June 12, 2025) · 検証 2026-09-30 · Claude (VOLO agent) · 解読 2026-09-30 · Claude (VOLO agent)
一次資料——これを行った当事者、あるいは記録を司る当局が公表したもの。連署は要りません。