Implementação realAutomatização cognitiva2025-04-22
A Uber diz que a sua ferramenta baseada em LLM produziu correções para 224 de 404 corridas de dados na sua base de código Go ao longo de 18 meses, e que os programadores aceitaram 193 delas na revisão de código
Programador backendpágina da profissão →Data do facto / publicação
2025-04-22
Categoria da prova
Implementação realUma empresa pô-lo em produção. Pode mover a linha de base, ponderado pela escala e por quanto esse contexto se parece com o teu.
Tarefas sobre as quais incide
Mantê-lo correto quando as coisas acontecem ao mesmo tempo
Transações, idempotência, novas tentativas, ordem — decidir o que nunca pode ser verdade e garantir que nunca é.
Continua a ser levada por uma pessoa✓ Com prova
Onde é que isto se aplica
Um artigo com revisão por pares, de engenheiros da Uber, sobre uma ferramenta que corre no próprio fluxo de trabalho de desenvolvimento da Uber. Ao longo de 18 meses identificou 404 corridas de dados reproduzíveis na base de código Go da Uber, produziu correções para 224 (55%), e os programadores aprovaram 193 delas (86%) na revisão de código; entre as correções rejeitadas havia algumas consideradas incorretas apesar de terem passado nos testes iniciais. A Uber não vende a ferramenta. Abrange corridas de dados de baixo nível numa linguagem e numa base de código, não transações, idempotência, novas tentativas nem ordem entre serviços, e cada correção passou pela revisão de uma pessoa.
O que isto significa
Parte do trabalho de concorrência — corrigir corridas de dados de baixo nível depois de encontradas — está agora a ser redigida por uma ferramenta numa grande empresa, com os responsáveis pelo código a decidir o que entra. A parte mais difícil, decidir o que nunca pode ser verdade entre serviços, não é o que ela faz.
O que ainda não mostra
A ferramenta de uma empresa para as corridas de dados de uma linguagem; não mostra menos engenheiros a trabalhar em concorrência nem nada sobre transações distribuídas.
O que podes verificar
Abre o arXiv:2504.15637 (Dr.Fix) e procura «193 of these patches (86%) were accepted by more than a hundred developers via code reviews».
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. O que este registo fez: 1 juízo de tarefa ligado em cima apoiam-se agora em prova em vez de em inferência.
Fonte
Uber — "Dr.Fix: Automatically Fixing Data Races at Industry Scale", arXiv:2504.15637 (22 April 2025; published at PLDI 2025) · verificado 2026-09-27 · Claude (VOLO agent) · interpretado 2026-09-27 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.