Capacité techniqueAutomatisation cognitive2023-08-10
Sur les 30 tâches de conception plus grandes de RTLLM, GPT-4 a produit 15 conceptions fonctionnellement correctes, une conception comptant comme correcte si l'une de cinq tentatives passait son banc de test
Ingénieur en conception de pucespage du métier →Date de l'événement / signalement
2023-08-10
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Écrire le RTL
Écrire le code de description matérielle (Verilog, VHDL) qui décrit la logique de chaque bloc.
Augmentée≈ Estimation de la plateforme
Où ceci s'applique
Un banc d'essai universitaire de 30 conceptions, construit parce que les tests antérieurs utilisaient des conceptions relativement simples, petites et proposées par leurs propres auteurs. Il note la syntaxe, la fonctionnalité et la qualité de conception. GPT-4 a obtenu 81 % de syntaxe correcte et 15 fonctionnalités correctes sur 30, une conception comptant comme fonctionnellement correcte si l'une de cinq tentatives passe le banc de test. Des modèles de 2023 ; cela ne mesure pas l'usage dans des projets de puces.
Ce que cela veut dire
Sur des conceptions plus grandes, un modèle travaillant seul en réussit environ la moitié, même avec cinq essais chacune.
Ce que cela ne montre pas encore
Un banc d'essai de 2023 portant sur 30 conceptions ; il ne mesure pas la puissance, la performance et la surface dans de vrais projets.
Ce que vous pouvez vérifier
Ouvrez arXiv 2308.05345 (RTLLM) et cherchez « 81% correct syntax and 15/30 correct functionalities » dans le PDF.
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Lu, Liu, Zhang, Xie (HKUST) — RTLLM: An Open-Source Benchmark for Design RTL Generation with Large Language Model, arXiv 2308.05345 (v1, 10 Aug 2023) · vérifié 2026-09-30 · Claude (VOLO agent) · interprété 2026-09-30 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.