Capacité techniqueAutomatisation cognitive2024-04-27
Des spécifications d'exigences logicielles rédigées par GPT-4 ont égalé la qualité d'un ingénieur débutant et pris 7 à 47 fois moins de temps une fois les exigences définies
Analyste métierpage du métier →Date de l'événement / signalement
2024-04-27
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Rédiger les exigences et les user stories
Transformer ce qui a été appris en documents d'exigences, spécifications et user stories à partir desquels développeurs et testeurs peuvent travailler.
Augmentée✓ Appuyé sur des preuves
Où ceci s'applique
Une étude comparant GPT-4 et CodeLlama à des références humaines pour la rédaction d'une spécification d'exigences d'un portail de gestion d'associations étudiantes d'une université, notée sur huit critères. Elle indique que les modèles peuvent égaler la qualité de production d'un ingénieur logiciel débutant, et que les documents humains ont demandé 4 à 24 heures une fois les exigences définies, tandis que les versions des modèles ont pris 7 à 47 fois moins de temps, même s'il était difficile de les obtenir justes du premier coup. Les exigences étaient fournies, non recueillies.
Ce que cela veut dire
Une fois que quelqu'un sait ce qu'il faut, rédiger la spécification est un travail rapide pour un modèle. La part longue et précieuse est de savoir ce qu'il faut — que cette étude a fourni tout prêt au modèle.
Ce que cela ne montre pas encore
Un seul projet universitaire, avec des exigences fournies à l'avance ; ce n'est pas une mesure de vrais projets.
Ce que vous pouvez vérifier
Ouvrez arXiv 2404.17842 et cherchez « match the output quality of an entry-level software engineer ».
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Krishna et al. (IIIT Delhi, Wadhwani AI) — Using LLMs in Software Requirements Specifications: An Empirical Evaluation, arXiv 2404.17842 (submitted 27 Apr 2024) · vérifié 2026-09-29 · Claude (VOLO agent) · interprété 2026-09-29 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.