Déploiement réelAutomatisation cognitive2025-04-22
Uber indique que son outil fondé sur un grand modèle de langage a produit en 18 mois des correctifs pour 224 des 404 courses aux données de sa base de code Go, et que les développeurs en ont accepté 193 en relecture de code
Développeur côté serveurpage du métier →Date de l'événement / signalement
2025-04-22
Stade de la preuve
Déploiement réelUn employeur l'a mis en production. Cela peut déplacer la ligne de base — pondéré par l'échelle et par la ressemblance du cadre avec le vôtre.
Tâches concernées
Rester juste quand les choses arrivent en même temps
Transactions, idempotence, reprises, ordre — décider ce qui ne doit jamais être vrai et s'assurer que cela ne l'est jamais.
Encore menée par des humains✓ Appuyé sur des preuves
Où ceci s'applique
Un article évalué par les pairs, écrit par des ingénieurs d'Uber, sur un outil intégré au propre flux de travail des développeurs d'Uber. En 18 mois, il a identifié 404 courses aux données reproductibles dans la base de code Go d'Uber et produit des correctifs pour 224 d'entre elles (55 %), et les développeurs en ont approuvé 193 (86 %) en relecture de code ; parmi les correctifs rejetés figuraient des correctifs jugés incorrects bien qu'ils aient passé les premiers tests. Uber ne vend pas l'outil. Il porte sur des courses aux données de bas niveau dans un seul langage et une seule base de code, non sur les transactions, l'idempotence, les reprises ou l'ordre entre services, et chaque correctif est passé par la relecture d'une personne.
Ce que cela veut dire
Une partie du travail de concurrence — corriger les courses aux données de bas niveau une fois qu'elles sont trouvées — est désormais rédigée par un outil dans une grande entreprise, les responsables du code décidant de ce qui est intégré. La partie la plus difficile, décider ce qui ne doit jamais être vrai entre services, n'est pas ce qu'il fait.
Ce que cela ne montre pas encore
L'outil d'une seule entreprise, sur les courses aux données d'un seul langage ; cela ne montre ni moins d'ingénieurs affectés à la concurrence, ni quoi que ce soit sur les transactions distribuées.
Ce que vous pouvez vérifier
Ouvrez arXiv:2504.15637 (Dr.Fix) et cherchez « 193 of these patches (86%) were accepted by more than a hundred developers via code reviews ».
Cela change-t-il l'évaluation ?
Non. L'indice d'impact n'est jamais déplacé par un seul événement. Ce que ce dossier a fait : 1 jugement de tâche lié ci-dessus repose désormais sur une preuve au lieu d'une inférence.
Source
Uber — "Dr.Fix: Automatically Fixing Data Races at Industry Scale", arXiv:2504.15637 (22 April 2025; published at PLDI 2025) · vérifié 2026-09-27 · Claude (VOLO agent) · interprété 2026-09-27 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.