RestriçãoAutomatização cognitiva2025-07-10
Um ensaio aleatorizado da METR com 16 programadores experientes de código aberto sobre 246 problemas reais concluiu que demoraram 19% mais com ferramentas de IA do início de 2025, enquanto acreditavam ter sido 20% mais rápidos
Engenheiro de software experientepágina da profissão →Data do facto / publicação
2025-07-10
Categoria da prova
RestriçãoUma falha, um recuo, uma regulação ou um custo estão a travar a adoção. Pode baixar uma avaliação ou alargar a sua incerteza.
Tarefas sobre as quais incide
Mudar um sistema que não escreveste
Fazer uma alteração dentro de um código grande e de vida longa em que as restrições não estão documentadas e vivem naquilo a que decisões anteriores já se comprometeram.
Continua a ser levada por uma pessoa✓ Com prova
Onde é que isto se aplica
Mantenedores experientes em repositórios grandes e maduros que conhecem bem (cerca de 5 anos cada um); as ferramentas eram sobretudo o Cursor Pro com o Claude 3.5/3.7 Sonnet. Os autores não afirmam em momento algum que o resultado se generalize à maioria dos programadores nem ao trabalho em projetos novos ou de nível júnior.
O que isto significa
Um registo de restrição na camada de capacidade e com um resultado medido: num ensaio aleatorizado, programadores experientes demoraram mais 19% com ferramentas do início de 2025 em problemas reais de repositórios que conheciam, enquanto acreditavam estar 20% mais rápidos. Para as tarefas ligadas, põe um teto até onde «o código de rotina é gerado» pode ser lido como «o trabalho ficou mais rápido», e a diferença de perceção é prova direta de por que é que depurar código gerado é onde o teto aparece.
O que ainda não mostra
Dizem-no os próprios autores: 16 programadores em repositórios maduros em que trabalhavam há cerca de cinco anos, com ferramentas que entretanto mudaram. Não mostra que os programadores júnior fiquem mais lentos (falta-lhes o conhecimento do repositório que aqui tornou as ferramentas menos úteis) e não mede a qualidade do código, a aprendizagem nem o trabalho de raiz. Um abrandamento naquele cenário não é um abrandamento no teu.
O que podes verificar
Durante uma semana, antes de começares cada tarefa escreve a tua estimativa de tempo com e sem o assistente, e depois regista o tempo real; o que a METR encontrou foi a diferença entre essas duas colunas, e um registo pessoal de dez tarefas mostra se tens a mesma diferença.
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. O que este registo fez: 1 juízo de tarefa ligado em cima apoiam-se agora em prova em vez de em inferência.
Fonte
METR — study report · verificado 2026-09-12 · Claude (agent) · interpretado 2026-09-10 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.
Este registo é citado em