Capacidade técnicaAutomatização cognitiva2023-12-10
O GPT-4 resolveu à primeira tentativa 43,5% dos problemas escritos por pessoas no VerilogEval, um teste de referência de 156 problemas de descrição de hardware que deixa de fora o consumo, o desempenho e a área
Engenheiro eletrotécnicopágina da profissão →Data do facto / publicação
2023-12-10
Categoria da prova
Capacidade técnicaUma demonstração, um referencial ou um artigo mostram que a tarefa pode ser feita. Atualiza o que a tecnologia consegue fazer, não o que as empresas vão fazer.
Tarefas sobre as quais incide
Projeto de circuitos, placas e chips
Projetar circuitos analógicos e digitais, escrever código de descrição de hardware e dispor placas e chips.
Aumentada pela máquina≈ Inferência da plataforma
Onde é que isto se aplica
Um teste de referência de 156 problemas do sítio didático de Verilog HDLBits, avaliados quanto à correção funcional por simulação face a uma solução de referência. Nos resultados corrigidos da v2, o GPT-4 resolveu 43,5% dos problemas escritos por pessoas à primeira tentativa e 58,9% em até dez tentativas; o GPT-3.5 resolveu 26,7%. Os autores notam que grande parte do projeto de hardware gira em torno da otimização do consumo, do desempenho e da área, que o teste de referência não mede. Testa problemas didáticos curtos com modelos de 2023; o empregador dos autores projeta chips e desenvolve IA para projeto de chips.
O que isto significa
Os modelos conseguem escrever, à primeira tentativa, código de hardware que funciona para uma minoria de problemas de tipo manual escolar. O trabalho de projeto que mais conta na prática — cumprir o consumo, o desempenho e a área — não é o que isto mede, e fica com o engenheiro.
O que ainda não mostra
Problemas didáticos curtos com modelos de 2023; não mede projetos reais de chips nem os modelos atuais.
O que podes verificar
Abre o arXiv 2309.07544 (VerilogEval), lê o resumo (156 problemas do HDLBits) e depois a Table II no PDF da v2.
Muda a avaliação?
Não, e esta categoria também não o move. Um registo de «Capacidade técnica» é prova a sério, mas por si só não sobe um juízo de tarefa. 1 juízo ligado em cima ficam onde estavam.
Fonte
Liu et al. (NVIDIA) — VerilogEval: Evaluating Large Language Models for Verilog Code Generation, arXiv 2309.07544 (v2, 10 Dec 2023) · verificado 2026-09-29 · Claude (VOLO agent) · interpretado 2026-09-29 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.