VOLOVLORisco de automatização e transição, tarefa a tarefa
PerguntarProfissõesCursosEmpresasEmpreenderMudançasNotasMétodoProcurar profissões, cursos…EN中文日本語ES
VLO
VOLO

Perceber como é que a automatização muda o trabalho, tarefa a tarefa, com a prova à vista e a incerteza assumida.

PerguntarProfissõesCursosEmpresasEmpreenderMudançasNotasMétodoQuem somosDiagnóstico de postosPrivacidadeCondições
© 2026 VOLO
Profissões
Todas as profissões
IA e software
Tradutor / IntérpreteCaixa de bancoCopywriterAssistente de apoio ao clienteAssistente administrativoTestador de software / engenheiro de QADesigner gráficoParalegalEditor de vídeoContabilista / Guarda-livrosEspecialista de marketingProgramador frontendAnalista de dadosGestor de sinistrosRedator técnico / engenheiro de documentaçãoProgramador de software júniorRecursos humanos / recrutamentoAnalista de crédito / gestor de riscoAnalista financeiroEspecialista de compras / cadeia de abastecimentoJornalistaComercial / gestor de contaAgente imobiliárioTécnico de suporte informático / helpdeskAuditorConsultor de gestãoProgramador backendInvestigador de IADesigner de produto / UXResponsável de sistemas de negócioEspecialista em operações de e-commerceRadiologistaEngenheiro de dadosAdvogadoAssistente médico / auxiliar de consultórioEngenheiro de aprendizagem automáticaEngenheiro de software experienteEngenheiro de DevOps / plataforma / SREGestor de produtoFarmacêuticoResponsável de parcerias / de canalAnalista de segurança (SOC)Responsável de conformidadeArquitetoChefe de primeira linha / chefe de equipaPsicoterapeuta / conselheiroVendedor / empregado de lojaSegurança / vigilanteProfessor do ensino básico e secundárioMédico de família / de cuidados primáriosEmpregado de mesaMecânico / técnico de automóveisFisioterapeuta / terapeuta de reabilitaçãoTrabalhador da construçãoEnfermeiroAuxiliar de ação direta / auxiliar de enfermagemResponsável de implementação de IA
RPA e autosserviço
Funcionário de atendimento ao públicoCoordenador de operaçõesRececionista
Robótica
Operador de caixa / empregado de lojaOperário de armazémOperário de linha de montagemTécnico de análises clínicasCozinheiro / chefPessoal de limpezaEletricista
Condução autónoma
Motorista de TVDE / táxiCamionistaEstafeta / entregador
Cursos
Todos os cursosEstudos ingleses / Línguas estrangeirasInformáticaContabilidadePsicologiaJornalismo / ComunicaçãoFinanças / EconomiaDireitoDesign de comunicação visualMarketingEnfermagemGestão de empresasEducação e formação de professoresArquiteturaAdministração pública
Guias
Perguntar à VOLOPara empresasPara quem empreendeMudanças recentesNotasDiagnóstico de postosMétodo e provaQuem somosSeguir uma profissãoProcurar
Entrar como:Tenho um empregoEstou a estudarDirijo uma empresaEstou a construir alguma coisa
Mudanças recentes›Engenheiro de aprendizagem automática›2024-10-09
Capacidade técnicaAutomatização cognitiva2024-10-09

A OpenAI construiu um teste de referência com 75 competições do Kaggle para medir agentes em engenharia de aprendizagem automática; a melhor montagem chegou a nível de medalha de bronze em 16,9% delas

Engenheiro de aprendizagem automáticapágina da profissão →
Data do facto / publicação
2024-10-09
Categoria da prova
Capacidade técnicaUma demonstração, um referencial ou um artigo mostram que a tarefa pode ser feita. Atualiza o que a tecnologia consegue fazer, não o que as empresas vão fazer.
Tarefas sobre as quais incide
Construir um modelo para o problema
Escolher uma arquitetura, treiná-la com os teus dados, afiná-la até os números mexerem.
A automatizar-se≈ Inferência da plataforma
Decidir o que conta como bom que chegue
Construir o conjunto de teste, escolher a métrica, e dizer se esta coisa já pode ser usada em pessoas reais.
Continua a ser levada por uma pessoa≈ Inferência da plataforma
Onde é que isto se aplica
Setenta e cinco competições do Kaggle de engenharia de aprendizagem automática — treinar modelos, preparar conjuntos de dados, correr experiências — classificadas contra as marcas humanas da tabela pública de cada competição, por isso a comparação é com as pessoas que de facto participaram. A montagem com melhor desempenho à data (o o1-preview com o andaime AIDE) chegou pelo menos ao bronze em 16,9% das competições; os autores indicam também que escalar os recursos e a contaminação do pré-treino mudam ambos o número, e o teste é de código aberto, por isso qualquer pessoa o pode voltar a correr num modelo mais recente. Dois limites são estruturais e não acidentais: uma competição do Kaggle chega com o problema já enquadrado, a métrica já escolhida e os dados já recolhidos, que é exatamente a parte deste trabalho que o teste não consegue medir de todo; e a OpenAI construiu o teste e vende modelos medidos por ele.
O que isto significa
Já existe uma medição pública e repetível da parte deste posto que mais se parece com um concurso: um problema enquadrado, uma métrica escolhida, um conjunto de dados preparado, e uma classificação de participantes reais contra quem perder. Nessa parte, no final de 2024 os agentes chegavam a nível de bronze em cerca de uma competição em cada seis, e o banco de ensaio é aberto, por isso o número mexe-se em público e não no diapositivo de um fornecedor.
O que ainda não mostra
O bronze numa competição não é um modelo em produção, e o banco de ensaio não consegue ver os passos que decidem se um lá chega: quem enquadrou a pergunta, porquê esta métrica e não a outra, se os dados de treino podem ser usados assim, e o que acontece no dia em que a distribuição muda. O número também nada diz sobre contratação. Lê a data ao lado dele: é uma medição de uma geração de modelos, e os próprios autores assinalam a contaminação do pré-treino como algo que a move.
O que podes verificar
Pega no último modelo que puseste em produção e escreve quem escolheu a métrica pela qual ele é avaliado. Se essa pessoa foste tu, a parte do teu posto que este banco testa não é a parte por que te pagam. Se foi outra pessoa, vale a pena perguntar-lhe como a escolheu.
Muda a avaliação?
Não, e esta categoria também não o move. Um registo de «Capacidade técnica» é prova a sério, mas por si só não sobe um juízo de tarefa. 2 juízos ligados em cima ficam onde estavam.
Fonte
MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering (OpenAI, arXiv:2410.07095) · verificado 2026-09-12 · Claude (VOLO agent) — arXiv abstract page read; the 75-competition count, the 16.9% bronze figure and the AIDE/o1-preview pairing taken from the authors' own abstract · interpretado 2026-09-12 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.
Todas as mudanças de Engenheiro de aprendizagem automática →Todas as mudanças recentes →Como é que um facto se torna prova →