Capacité techniqueAutomatisation cognitive2024-06-26
94 % des copies d'examen rédigées par IA sont passées inaperçues à l'université de Reading, avec des notes supérieures en moyenne d'une demi-tranche de mention à celles des vrais étudiants
Enseignant-chercheurpage du métier →Date de l'événement / signalement
2024-06-26
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Conception des évaluations et intégrité
Concevoir des examens et des travaux qui mesurent ce que les étudiants savent faire, et veiller à l'intégrité académique.
Nouvelle tâche✓ Appuyé sur des preuves
Où ceci s'applique
Royaume-Uni, les examens de psychologie d'une université. Les chercheurs ont soumis des réponses rédigées par IA à de vrais examens à faire chez soi à l'insu des correcteurs, et indiquent que 94 % des copies d'IA sont passées inaperçues, 97 % selon un critère plus strict, et que les notes attribuées étaient en moyenne supérieures d'une demi-tranche de mention à celles des vrais étudiants. C'est un seul département et une seule série d'examens, avec des modèles de l'époque de 2023 ; les auteurs ont déclaré n'avoir aucun conflit d'intérêts.
Ce que cela veut dire
L'évaluation écrite sans surveillance ne mesure plus de manière fiable ce qu'un étudiant sait faire. Le travail qui en découle — refondre l'évaluation — retombe sur les enseignants-chercheurs.
Ce que cela ne montre pas encore
Les examens d'un seul département avec des modèles plus anciens ; cela ne mesure pas la pratique dans les universités.
Ce que vous pouvez vérifier
Ouvrez l'article de PLOS ONE de Scarfe et al. (2024) et cherchez « 94% of our AI submissions were undetected ».
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Scarfe, Watcham, Clarke et al. (University of Reading) — A real-world test of artificial intelligence infiltration of a university examinations system: A 'Turing Test' case study, PLOS ONE (published June 26, 2024) · vérifié 2026-09-30 · Claude (VOLO agent) · interprété 2026-09-30 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.