Capacité techniqueAutomatisation cognitive2025-06-12
Des psychologues agréés ont en général mieux noté les rapports psychologiques rédigés par des humains que ceux de GPT-4, mais les tailles d'effet étaient le plus souvent faibles, selon une étude portant sur 249 évaluateurs
Psychologuepage du métier →Date de l'événement / signalement
2025-06-12
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Rédiger le rapport d'évaluation
Transformer les résultats des tests, l'histoire de la personne et l'observation en une évaluation écrite assortie de recommandations.
Augmentée✓ Appuyé sur des preuves
Où ceci s'applique
Une étude dans laquelle 249 psychologues agréés ont évalué des rapports psychologiques rédigés par des psychologues humains et par ChatGPT-4 selon la qualité, la lisibilité, le style, l'organisation, les synthèses, les recommandations, la préférence et la disposition à les valider. Les rapports humains ont en général été mieux notés et les évaluateurs étaient plus à l'aise pour les approuver, mais les tailles d'effet étaient le plus souvent faibles ; les synthèses humaines étaient modérément meilleures, et les rapports de l'IA modérément meilleurs pour les recommandations. Elle note des rapports, pas une pratique.
Ce que cela veut dire
Un rapport d'évaluation rédigé par l'IA est déjà assez proche pour que les notes des psychologues le distinguent à peine des leurs.
Ce que cela ne montre pas encore
Une seule étude de notation avec GPT-4 ; elle ne montre ni les taux d'erreur sur des cas réels ni qui signe le rapport.
Ce que vous pouvez vérifier
Ouvrez l'article du Journal of Psychoeducational Assessment « Human vs. Machine » et cherchez « effect sizes were typically small ».
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Lockwood et al. — Human vs. Machine: Comparing AI-Generated and Human-Written Psychological Reports, Journal of Psychoeducational Assessment (first published online June 12, 2025) · vérifié 2026-09-30 · Claude (VOLO agent) · interprété 2026-09-30 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.