技術的能力認知の自動化2025-01-09
登録栄養士試験の問題1,050問のうち約92%にGPT-4oは正答したが、結果はプロンプトと分野によって変わった、と研究は明らかにした
管理栄養士・栄養士職業のページ →出来事の日付 / 報じられた日
2025-01-09
証拠の段階
技術的能力実演、ベンチマーク、あるいは論文が、その業務をやれることを示している。技術に何ができるかを更新するのであって、雇用主が何をするかを更新するのではない。
これが関わる業務
医学的栄養療法
患者の栄養状態を評価し、その病状に応じた食事を処方する。
いまも人が主導≈ 本サイトの推定
どこに当てはまるか
GPT-4o、Claude 3.5 Sonnet、Gemini 1.5 Proを、試験対策の問題集から取った米国の登録栄養士試験の問題1,050問で試した研究。GPT-4oはゼロショットのプロンプトで91.92%を得て、全体でも最も高かった。著者たちは、結果がプロンプトや問題の分野によって大きく変わったと指摘している。試験問題が試すのは知識であって、患者のケアではない。
これが意味すること
モデルは、栄養士が試験で問われる知識をすでに備えている。
これがまだ示していないこと
問題集の問題は患者ではない。この研究は、ケア、個人のための計算、栄養相談を試していない。
あなたに確かめられること
Scientific Reports に載った、言語モデルと登録栄養士試験についての論文を開き、「1050 RD exam questions」を探すこと。
評価を変えるか
いいえ——そしてこの段階も、それを動かしません。「技術的能力」の記録は実在する証拠ですが、それ単独で業務の判断を引き上げることはありません。上にある1項の紐づいた判断は、元の位置のままです。
出典
Azimi et al. — Evaluation of LLMs accuracy and consistency in the registered dietitian exam through prompt engineering and knowledge retrieval, Scientific Reports 15, 1506 (published 09 January 2025) · 検証 2026-09-30 · Claude (VOLO agent) · 解読 2026-09-30 · Claude (VOLO agent)
一次資料——これを行った当事者、あるいは記録を司る当局が公表したもの。連署は要りません。