Déploiement réelAutomatisation cognitive2026-07-30
Uber indique que son système de test mobile par IA fait tourner en permanence 1 013 tests de bout en bout dans son intégration continue et a fait de ses ingénieurs de test, autrefois des « clickers », des personnes qui construisent son contexte
Testeur logiciel / ingénieur qualitépage du métier →Date de l'événement / signalement
2026-07-30
Stade de la preuve
Déploiement réelUn employeur l'a mis en production. Cela peut déplacer la ligne de base — pondéré par l'échelle et par la ressemblance du cadre avec le vôtre.
Tâches concernées
Les tests de régression manuels
Cliquer dans les mêmes parcours à chaque livraison pour confirmer que rien de ce qui fonctionnait n'a cassé.
En cours d'automatisation✓ Appuyé sur des preuves
Où ceci s'applique
Un article d'ingénieurs d'Uber sur un système qui tourne dans les propres chaînes d'Uber. Il indique que DragonCrawl atteint un taux de réussite de 91,6 % sur iOS et de 92,2 % sur Android sur 1 013 tests automatisés exécutés en continu dans les chaînes CI/CD, qu'il a ramené la mise en place d'un test de 96 à 120 heures à moins de 4, et qu'il a permis d'économiser, selon une estimation, 27 années-développeur de maintenance des tests ; les ingénieurs de test qui exécutaient auparavant des scripts ont été repositionnés comme « Context Engineers » plutôt que « Clickers », et Uber dit avoir obtenu une assurance qualité capable de passer à l'échelle sans croissance proportionnelle des effectifs. Les gains de temps sont des estimations d'Uber, et cela porte sur les tests mobiles de bout en bout d'une seule entreprise.
Ce que cela veut dire
Cliquer dans les mêmes parcours de l'application à chaque livraison est en train de passer, dans une grande entreprise, à un modèle qui pilote lui-même l'application. Les testeurs qui cliquaient écrivent maintenant ce que le système doit savoir — le rôle passe de l'exécution à la spécification.
Ce que cela ne montre pas encore
Le récit et les estimations d'une seule entreprise ; elle dit que les effectifs n'ont pas augmenté en proportion, non qu'ils ont baissé, et cela ne couvre que les tests mobiles.
Ce que vous pouvez vérifier
Ouvrez arXiv:2607.28750 (DragonCrawl) et cherchez « across 1,013 automated tests running continuously in CI/CD pipelines ».
Cela change-t-il l'évaluation ?
Non. L'indice d'impact n'est jamais déplacé par un seul événement. Ce que ce dossier a fait : 1 jugement de tâche lié ci-dessus repose désormais sur une preuve au lieu d'une inférence.
Source
Uber — "DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing", arXiv:2607.28750 (30 July 2026; accepted at ASE-Industry 2026) · vérifié 2026-09-27 · Claude (VOLO agent) · interprété 2026-09-27 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.