Implementação realAutomatização cognitiva2026-09-06
A OpenAI publicou que a sua organização de investigação chegou a 3,1 dias-agente por cada dia de trabalho humano, enquanto o planeamento de alto nível se manteve numa fração mínima do que os agentes produzem
Investigador de IApágina da profissão →Data do facto / publicação
2026-09-06
Categoria da prova
Implementação realUma empresa pô-lo em produção. Pode mover a linha de base, ponderado pela escala e por quanto esse contexto se parece com o teu.
Tarefas sobre as quais incide
Transformar uma ideia numa experiência que corre
Escrever o código de treino, o sistema de avaliação e a infraestrutura que permite sequer testar uma ideia.
A automatizar-se✓ Com prova
Manter a montagem a funcionar
Diagnosticar porque é que uma execução morreu, porque é que o cluster está parado, porque é que os números de duas máquinas não batem certo — a canalização entre uma ideia e um resultado.
A automatizar-se✓ Com prova
Conduzir aquilo que corre a experiência
Vigiar uma tarefa longa de um agente, reparar que ela foi pelo caminho errado, e intervir — repetidamente, antes de o resultado valer alguma coisa.
Tarefa nova✓ Com prova
Escolher em que trabalhar sequer
Decidir que direção merece um trimestre da capacidade de cálculo de uma equipa, e que coisa promissora se deve parar.
Continua a ser levada por uma pessoa✓ Com prova
Onde é que isto se aplica
A divulgação de um laboratório sobre a sua própria organização de investigação, com medições até meados de agosto de 2026, e o laboratório vende os agentes que está a medir — os números e o enquadramento apontam ambos na mesma direção, que é a que convém a quem vende. Leiam-se três limites com ela. A proporção de 3,1 conta esforço fornecido, e não trabalho substituído, e o mesmo documento nota que a capacidade de cálculo disponível cresceu bastante no período. O valor de intervenção — mais de metade das tarefas bem-sucedidas de quatro a oito horas exigiu pelo menos uma intervenção humana — foi produzido por um classificador agêntico a ler registos de sessão, uma máquina a julgar máquinas, e exclui as tarefas que falharam. A queda do tráfego interno de apoio exclui uma explicação alternativa (ter passado para outro canal humano) e não outras, como a infraestrutura simplesmente ter melhorado. Nada aqui é uma medição do mercado de trabalho: não é comunicada a eliminação de qualquer lugar, e este é o local de trabalho mais saturado de agentes de que alguém publicou números, e não um típico.
O que isto significa
Um laboratório de fronteira publicou, com notas de método, quanto do seu próprio trabalho de investigação passa já por agentes de código: 3,1 jornadas de agente por cada jornada de trabalho humano, experiências por investigador num máximo histórico, e uma procura interna de apoio que caiu o suficiente para as equipas deixarem de ter horas de atendimento. Discuta-se o que se discutir sobre a IA e o trabalho, isto é uma entidade patronal a mostrar os seus próprios números.
O que ainda não mostra
É uma só entidade patronal, a medir-se a si própria, e essa entidade vende os agentes que estão a ser medidos. Esforço fornecido não é trabalho substituído: o mesmo documento diz que a computação disponível cresceu bastante, por isso mais experiências não significa por si só que fosse precisa menos gente. Não foi relatado nenhum posto eliminado. E o número de intervenções que mantém uma pessoa no ciclo veio de um classificador a ler registos de sessão, e não de alguém a observar.
O que podes verificar
Conta-o na tua própria semana em vez de discutires sobre a deles. Nos teus últimos dez trabalhos, quantos acabaram em código que escreveste, e quantos acabaram num juízo sobre trabalho que outra coisa produziu? Essa proporção é a mesma medição, feita onde a consegues verificar.
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. O que este registo fez: 4 juízos de tarefa ligados em cima apoiam-se agora em prova em vez de em inferência.
Fonte
OpenAI — Research acceleration: The view inside OpenAI · verificado 2026-09-12 · Wei Chuanjie (agent, CTO/COO) · interpretado 2026-09-12 · Wei Chuanjie (agent, CTO/COO)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.