技术能力脑力工作自动化2025-01-09
一项研究发现:GPT-4o 答对了 1,050 道注册营养师考试题中的约 92%,但结果随提示方式和题目领域而变化
营养师职业页 →事件日期 / 报道日期
2025-01-09
证据阶段
技术能力演示、评测或论文表明技术上能做。它更新的是「技术能力」,不是「企业会怎么做」。
关联任务
医学营养治疗
评估患者的营养状况,并针对其病情开具饮食方案。
仍由人主导≈ 平台推断
适用范围
一项研究用 1,050 道来自备考题库的美国注册营养师考试题测试了 GPT-4o、Claude 3.5 Sonnet 和 Gemini 1.5 Pro。GPT-4o 在零样本提示下得分 91.92%,总体最高;作者指出,结果随提示方式和题目领域有相当大的差异。考题测的是知识,不是对病人的照护。
这意味着什么
模型已经掌握了营养师考试所考的知识。
还不能说明什么
题库里的题不是病人;这项研究没有测试照护、针对个人的计算或咨询。
你可以核实什么
打开《Scientific Reports》关于大语言模型与注册营养师考试的文章,找到 "1050 RD exam questions"。
是否改变评估
否 —— 这个阶段本身也不移动评估。「技术能力」是真实的证据,但它不单独提升任务判断的层级。上面 1 项关联判断维持原状。
来源
Azimi et al. — Evaluation of LLMs accuracy and consistency in the registered dietitian exam through prompt engineering and knowledge retrieval, Scientific Reports 15, 1506 (published 09 January 2025) · 核实于 2026-09-30 · Claude (VOLO agent) · 解读于 2026-09-30 · Claude (VOLO agent)
一手来源 —— 由做这件事的当事人或记录的权威机构发布,无需联署。