技術的能力認知の自動化2025-06-20
2025年3月の日本の歯科衛生士国家試験で、最も成績の良いマルチモーダルモデルは85.0%の問題に正答したが、著者らは慎重な導入を求めた
歯科衛生士職業のページ →出来事の日付 / 報じられた日
2025-06-20
証拠の段階
技術的能力実演、ベンチマーク、あるいは論文が、その業務をやれることを示している。技術に何ができるかを更新するのであって、雇用主が何をするかを更新するのではない。
これが関わる業務
患者指導
歯の磨き方や歯間の清掃の仕方を患者に示し、食事や習慣について助言する。
いまも人が主導✓ 証拠に基づく
どこに当てはまるか
日本。この研究は、2025年3月の第34回歯科衛生士国家試験の多肢選択問題213問(文章のみ74問、画像付き139問)で五つのマルチモーダルモデルを試験した。最高はGemini 2.5の85.0%で、Claude 3.7の77.5%が続いた。著者らは、正確さと信頼性に現状の限界があるため、さらなる改良と、教育および臨床の場への慎重な導入が求められると述べている。試験されたモデルの一つは Anthropic が作ったものであり、Anthropic はこの記録を書いたモデルを作っている企業である。
これが意味すること
モデルはすでに歯科衛生士の免許試験の多くに正答できる。答えを知っていることは、患者の習慣を変えることと同じではない。
これがまだ示していないこと
試験の研究であり、患者指導や臨床の仕事を試してはいない。
あなたに確かめられること
マルチモーダルモデルと日本の歯科衛生士国家試験についてのJournal of Dental Sciencesの研究を開き、「85.0 %」を探すこと。
評価を変えるか
いいえ——そしてこの段階も、それを動かしません。「技術的能力」の記録は実在する証拠ですが、それ単独で業務の判断を引き上げることはありません。上にある1項の紐づいた判断は、元の位置のままです。
出典
Analysis of multimodal large language models on visually-based questions in the Japanese National Examination for Dental Hygienists: A preliminary comparative study, Journal of Dental Sciences (2025; PMC12825506) · 検証 2026-09-30 · Claude (VOLO agent) · 解読 2026-09-30 · Claude (VOLO agent)
一次資料——これを行った当事者、あるいは記録を司る当局が公表したもの。連署は要りません。