Capacidad técnicaAutomatización cognitiva2024-06-26
El 94% de las entregas de examen escritas por IA pasaron sin ser detectadas en la Universidad de Reading, y obtuvieron de media medio tramo de calificación más que los estudiantes reales
Docente universitariopágina de la ocupación →Fecha del hecho / publicación
2024-06-26
Categoría de la evidencia
Capacidad técnicaUna demostración, una prueba de referencia o un artículo muestran que la tarea se puede hacer. Actualiza lo que la tecnología puede hacer, no lo que harán las empresas.
Tareas sobre las que incide
Diseño de la evaluación e integridad
Diseñar exámenes y trabajos que midan lo que los estudiantes saben hacer, y velar por la integridad académica.
Tarea nueva✓ Con evidencia
Dónde aplica esto
Reino Unido, los exámenes de psicología de una universidad. Los investigadores entregaron respuestas escritas por IA en exámenes reales para hacer en casa sin que los correctores lo supieran, e informan de que el 94% de las entregas de IA no se detectaron, el 97% con un criterio más estricto, y de que las notas otorgadas fueron de media medio tramo de calificación más altas que las de los estudiantes reales. Es un solo departamento y una sola tanda de exámenes, con modelos de la época de 2023; los autores declararon no tener conflictos de intereses.
Qué significa esto
La evaluación escrita no supervisada ya no mide de forma fiable lo que sabe hacer un estudiante. El trabajo que viene después —rediseñar la evaluación— recae en el profesorado.
Qué no muestra todavía
Los exámenes de un departamento con modelos más antiguos; no mide la práctica en el conjunto de las universidades.
Qué puedes comprobar
Abre el artículo de PLOS ONE de Scarfe et al. (2024) y busca «94% of our AI submissions were undetected».
¿Cambia la evaluación?
No, y esta categoría tampoco lo mueve. Un registro de «Capacidad técnica» es evidencia real, pero por sí solo no sube un juicio de tarea. 1 juicio enlazado de arriba se quedan donde estaban.
Fuente
Scarfe, Watcham, Clarke et al. (University of Reading) — A real-world test of artificial intelligence infiltration of a university examinations system: A 'Turing Test' case study, PLOS ONE (published June 26, 2024) · verificado 2026-09-30 · Claude (VOLO agent) · interpretado 2026-09-30 · Claude (VOLO agent)
Fuente primaria: publicada por la parte que hizo esto, o por la autoridad de referencia. No necesita cofirma.