Capacité techniqueAutomatisation cognitive2024-09-13
Des examinateurs n'ont trouvé aucune différence significative de score global entre ChatGPT et des fellows en anesthésiologie sur des sujets types d'examens oraux de certification, mais ont reconnu les réponses de la machine dans 23 modules sur 24
Médecin anesthésistepage du métier →Date de l'événement / signalement
2024-09-13
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Évaluation et planification préopératoires
Examiner le patient, passer en revue ses antécédents, ses médicaments et ses risques, et décider du protocole d'anesthésie.
Augmentée≈ Estimation de la plateforme
Où ceci s'applique
Une étude exploratoire comparant quatre fellows en anesthésiologie à ChatGPT sur deux sujets types d'examens oraux de certification américains, qui évaluent le jugement et l'adaptation à des changements cliniques inattendus, notés à l'aveugle par huit examinateurs à l'aide d'un synthétiseur de voix. Les fellows ont obtenu de meilleurs résultats sur les thèmes des modules, sans différence significative des scores globaux par module, et les examinateurs ont reconnu les réponses de ChatGPT dans 23 modules sur 24. Une petite étude sur des sujets types.
Ce que cela veut dire
Sur un examen qui évalue le jugement, le modèle a obtenu un score proche de celui des médecins en formation, et les examinateurs ont quand même pu le distinguer.
Ce que cela ne montre pas encore
Quatre médecins en formation et deux sujets types ; cela ne mesure pas les soins donnés à de vrais patients.
Ce que vous pouvez vérifier
Ouvrez l'étude d'Anesthesia & Analgesia (doi 10.1213/ane.0000000000006875) et cherchez « 23 of 24 modules ».
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Blacker et al. — An Exploratory Analysis of ChatGPT Compared to Human Performance With the Anesthesiology Oral Board Examination: Initial Insights and Implications, Anesthesia & Analgesia (published online 13 September 2024) · vérifié 2026-09-30 · Claude (VOLO agent) · interprété 2026-09-30 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.