Implementação realAutomatização cognitiva2026-07-30
A Uber diz que o seu sistema de IA de testes de aplicações móveis corre permanentemente 1.013 testes de ponta a ponta na integração contínua e que transformou os seus engenheiros de testes de «clickers» em pessoas que lhe constroem o contexto
Testador de software / engenheiro de QApágina da profissão →Data do facto / publicação
2026-07-30
Categoria da prova
Implementação realUma empresa pô-lo em produção. Pode mover a linha de base, ponderado pela escala e por quanto esse contexto se parece com o teu.
Tarefas sobre as quais incide
Testes de regressão manuais
Clicar pelos mesmos percursos em cada versão para confirmar que não se partiu nada do que funcionava.
A automatizar-se✓ Com prova
Onde é que isto se aplica
Um artigo de engenheiros da Uber sobre um sistema que corre nos pipelines da própria Uber. Diz que o DragonCrawl atinge uma taxa de sucesso de 91,6% em iOS e de 92,2% em Android em 1.013 testes automatizados que correm em contínuo em CI/CD, que reduziu a integração de um teste de 96–120 horas para menos de 4 e que poupou uma estimativa de 27 anos de trabalho de programadores em manutenção de testes; os engenheiros de testes que antes executavam guiões foram reposicionados como «Context Engineers» em vez de «Clickers», e a Uber diz ter conseguido uma garantia de qualidade escalável sem um crescimento proporcional dos efetivos. As poupanças de tempo são estimativas da própria Uber, e isto cobre testes móveis de ponta a ponta numa só empresa.
O que isto significa
Clicar pelos mesmos percursos da aplicação em cada versão está a passar para um modelo que conduz ele próprio a aplicação, numa grande empresa. Os testadores que faziam os cliques escrevem agora o que o sistema precisa de saber — o lugar passa de executar para especificar.
O que ainda não mostra
O relato e as estimativas da própria empresa; diz que os efetivos não cresceram na mesma proporção, e não que tenham diminuído, e só cobre testes móveis.
O que podes verificar
Abre o arXiv:2607.28750 (DragonCrawl) e procura «across 1,013 automated tests running continuously in CI/CD pipelines».
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. O que este registo fez: 1 juízo de tarefa ligado em cima apoiam-se agora em prova em vez de em inferência.
Fonte
Uber — "DragonCrawl: A Generative, Intent-Based Framework for Scalable Mobile End-to-End Testing", arXiv:2607.28750 (30 July 2026; accepted at ASE-Industry 2026) · verificado 2026-09-27 · Claude (VOLO agent) · interpretado 2026-09-27 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.