Despliegue realAutomatización cognitiva2025-04-22
Uber dice que su herramienta basada en LLM produjo correcciones para 224 de 404 carreras de datos en su base de código Go a lo largo de 18 meses, y que los desarrolladores aceptaron 193 de ellas en la revisión de código
Desarrollador backendpágina de la ocupación →Fecha del hecho / publicación
2025-04-22
Categoría de la evidencia
Despliegue realUna empresa lo ha puesto en producción. Puede mover la línea de base, ponderado por la escala y por cuánto se parece ese entorno al tuyo.
Tareas sobre las que incide
Mantenerlo correcto cuando las cosas pasan a la vez
Transacciones, idempotencia, reintentos, orden — decidir qué no puede ser verdad nunca y asegurarse de que nunca lo es.
Sigue llevándola una persona✓ Con evidencia
Dónde aplica esto
Un artículo revisado por pares de ingenieros de Uber sobre una herramienta que funciona en el propio flujo de trabajo de desarrollo de Uber. A lo largo de 18 meses identificó 404 carreras de datos reproducibles en la base de código Go de Uber, produjo correcciones para 224 (el 55%), y los desarrolladores aprobaron 193 de ellas (el 86%) en la revisión de código; entre las correcciones rechazadas había algunas consideradas incorrectas pese a pasar las pruebas iniciales. Uber no vende la herramienta. Abarca carreras de datos de bajo nivel en un solo lenguaje y una sola base de código, no transacciones, idempotencia, reintentos ni orden entre servicios, y cada corrección pasó por la revisión de una persona.
Qué significa esto
Parte del trabajo de concurrencia — corregir carreras de datos de bajo nivel una vez encontradas — la redacta ya una herramienta en una gran empresa, y son los responsables del código quienes deciden qué entra. La parte más difícil, decidir qué no puede ser verdad nunca entre servicios, no es lo que hace.
Qué no muestra todavía
La herramienta de una empresa sobre las carreras de datos de un lenguaje; no muestra menos ingenieros dedicados a la concurrencia ni nada sobre transacciones distribuidas.
Qué puedes comprobar
Abre arXiv:2504.15637 (Dr.Fix) y busca «193 of these patches (86%) were accepted by more than a hundred developers via code reviews».
¿Cambia la evaluación?
No. El índice de impacto no lo mueve nunca un solo hecho. Lo que sí hizo este registro: 1 juicio de tarea enlazado de arriba se apoyan ahora en evidencia en vez de en inferencia.
Fuente
Uber — "Dr.Fix: Automatically Fixing Data Races at Industry Scale", arXiv:2504.15637 (22 April 2025; published at PLDI 2025) · verificado 2026-09-27 · Claude (VOLO agent) · interpretado 2026-09-27 · Claude (VOLO agent)
Fuente primaria: publicada por la parte que hizo esto, o por la autoridad de referencia. No necesita cofirma.