Despliegue realAutomatización cognitiva2026-07-30
Uber dice que su sistema de IA para pruebas móviles ejecuta de forma continua 1.013 pruebas de extremo a extremo en integración continua y ha convertido a sus ingenieros de pruebas de «clickers» en personas que construyen su contexto
Tester de software / ingeniero de QApágina de la ocupación →Fecha del hecho / publicación
2026-07-30
Categoría de la evidencia
Despliegue realUna empresa lo ha puesto en producción. Puede mover la línea de base, ponderado por la escala y por cuánto se parece ese entorno al tuyo.
Tareas sobre las que incide
Pruebas de regresión manuales
Pinchar por los mismos flujos en cada versión para confirmar que no se ha roto nada de lo que funcionaba.
Automatizándose✓ Con evidencia
Dónde aplica esto
Un artículo de ingenieros de Uber sobre un sistema que funciona en las propias canalizaciones de Uber. Dice que DragonCrawl logra una tasa de pruebas superadas del 91,6% en iOS y del 92,2% en Android en 1.013 pruebas automatizadas que corren de forma continua en CI/CD, que redujo el tiempo de incorporar una prueba de 96–120 horas a menos de 4, y que ahorró en mantenimiento de pruebas lo que estima en 27 años de trabajo de desarrollador; los ingenieros de pruebas que antes ejecutaban guiones pasaron a ser «Context Engineers» en lugar de «Clickers», y Uber dice que logró un aseguramiento de la calidad escalable sin un crecimiento proporcional de la plantilla. El ahorro de tiempo son estimaciones propias de Uber, y abarca pruebas móviles de extremo a extremo en una sola empresa.
Qué significa esto
Pinchar por los mismos flujos de la aplicación en cada versión lo está asumiendo, en una gran empresa, un modelo que maneja la propia aplicación. Los testers que hacían esos clics ahora escriben lo que el sistema necesita saber — el papel pasa de ejecutar a especificar.
Qué no muestra todavía
El relato y las estimaciones propias de una empresa; dice que la plantilla no creció en proporción, no que bajara, y solo cubre pruebas móviles.
Qué puedes comprobar
Abre arXiv:2607.28750 (DragonCrawl) y busca «across 1,013 automated tests running continuously in CI/CD pipelines».
¿Cambia la evaluación?
No. El índice de impacto no lo mueve nunca un solo hecho. Lo que sí hizo este registro: 1 juicio de tarea enlazado de arriba se apoyan ahora en evidencia en vez de en inferencia.
Fuente
Uber — "DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing", arXiv:2607.28750 (30 July 2026; accepted at ASE-Industry 2026) · verificado 2026-09-27 · Claude (VOLO agent) · interpretado 2026-09-27 · Claude (VOLO agent)
Fuente primaria: publicada por la parte que hizo esto, o por la autoridad de referencia. No necesita cofirma.