RestricciónAutomatización cognitiva2025-07-10
Un ensayo aleatorizado de METR con 16 desarrolladores de código abierto con experiencia sobre 246 incidencias reales halló que tardaron un 19% más con herramientas de IA de principios de 2025, mientras creían haber ido un 20% más rápido
Ingeniero de software con experienciapágina de la ocupación →Fecha del hecho / publicación
2025-07-10
Categoría de la evidencia
RestricciónUn fallo, una marcha atrás, una regulación o un coste están frenando la adopción. Puede bajar una evaluación o ensanchar su incertidumbre.
Tareas sobre las que incide
Cambiar un sistema que no escribiste
Hacer un cambio dentro de un código grande y de larga vida donde las restricciones no están documentadas y viven en aquello a lo que ya se comprometieron decisiones anteriores.
Sigue llevándola una persona✓ Con evidencia
Dónde aplica esto
Mantenedores con experiencia sobre repositorios grandes y maduros que conocen bien (unos 5 años cada uno); las herramientas eran sobre todo Cursor Pro con Claude 3.5/3.7 Sonnet. Los autores no afirman en ningún momento que el resultado se generalice a la mayoría de los desarrolladores ni al trabajo en proyectos nuevos o de nivel júnior.
Qué significa esto
Un registro de restricción en la capa de capacidad y con un resultado medido: en un ensayo aleatorizado, programadores con experiencia tardaron un 19% más con herramientas de principios de 2025 en incidencias reales de repositorios que conocían, mientras creían que iban un 20% más rápido. Para las tareas vinculadas, pone un tope a hasta dónde puede leerse «el código rutinario se genera» como «el trabajo se hizo más rápido», y la brecha de percepción es evidencia directa de por qué depurar código generado es donde aparece el techo.
Qué no muestra todavía
Lo dicen los propios autores: 16 desarrolladores en repositorios maduros en los que llevaban unos cinco años trabajando, con herramientas que desde entonces han cambiado. No muestra que los desarrolladores junior se vuelvan más lentos (les falta el conocimiento del repositorio que aquí hizo menos útiles a las herramientas) y no mide la calidad del código, el aprendizaje ni el trabajo desde cero. Una ralentización en ese escenario no es una ralentización en el tuyo.
Qué puedes comprobar
Durante una semana, antes de empezar cada incidencia escribe tu estimación de tiempo con y sin el asistente, y después registra el tiempo real; lo que encontró METR fue la diferencia entre esas dos columnas, y un registro personal de diez incidencias muestra si tú tienes la misma diferencia.
¿Cambia la evaluación?
No. El índice de impacto no lo mueve nunca un solo hecho. Lo que sí hizo este registro: 1 juicio de tarea enlazado de arriba se apoyan ahora en evidencia en vez de en inferencia.
Fuente
METR — study report · verificado 2026-09-12 · Claude (agent) · interpretado 2026-09-10 · Claude (VOLO agent)
Fuente primaria: publicada por la parte que hizo esto, o por la autoridad de referencia. No necesita cofirma.
Este registro se cita en