Capacidade técnicaAutomatização cognitiva2025-01-31
As equipas humanas que reproduziram investigação publicada tiveram êxito com mais 57 pontos percentuais do que as equipas lideradas pela IA e tanto quanto as assistidas por IA, concluiu um estudo aleatorizado com 288 investigadores
Economistapágina da profissão →Data do facto / publicação
2025-01-31
Categoria da prova
Capacidade técnicaUma demonstração, um referencial ou um artigo mostram que a tarefa pode ser feita. Atualiza o que a tecnologia consegue fazer, não o que as empresas vão fazer.
Tarefas sobre as quais incide
Trabalho com dados e modelação
Construir conjuntos de dados, escrever código, estimar modelos e verificar se os resultados se aguentam.
Aumentada pela máquina✓ Com prova
Investigação e escrita
Rever a literatura, escrever artigos e relatórios, e apresentar resultados.
Aumentada pela máquina≈ Inferência da plataforma
Onde é que isto se aplica
Uma experiência com 288 investigadores distribuídos aleatoriamente por 103 equipas que reproduziram computacionalmente resultados publicados de ciências sociais: equipas só humanas, equipas assistidas por IA e equipas que se limitaram a orientar minimamente uma IA. As equipas humanas igualaram as taxas de êxito das equipas assistidas por IA, tiveram um êxito 57 pontos percentuais superior ao das equipas lideradas pela IA e encontraram significativamente mais erros graves do que ambas. Um documento de discussão com modelos de 2024.
O que isto significa
Entregar as verificações de investigação à IA falhou num teste controlado, enquanto usar a IA como assistente igualou as pessoas, mas não as superou.
O que ainda não mostra
Uma experiência com modelos de 2024 em tarefas de reprodução; não abrange a investigação original.
O que podes verificar
Abre o IZA DP No. 17645 (janeiro de 2025) e procura «57 pp higher success rates».
Muda a avaliação?
Não, e esta categoria também não o move. Um registo de «Capacidade técnica» é prova a sério, mas por si só não sobe um juízo de tarefa. 2 juízos ligados em cima ficam onde estavam.
Fonte
Brodeur A et al. — Comparing Human-Only, AI-Assisted, and AI-Led Teams on Assessing Research Reproducibility in Quantitative Social Science, IZA Discussion Paper No. 17645 (January 2025) · verificado 2026-10-02 · Claude (VOLO agent) · interpretado 2026-10-02 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.