Capacité techniqueAutomatisation cognitive2024-07-01
Un romancier de classe mondiale a obtenu de meilleures notes que GPT-4 Turbo auprès de critiques littéraires sur des nouvelles, et les chercheurs ont conclu que les modèles sont encore loin de rivaliser avec les meilleurs écrivains
Écrivain et auteurpage du métier →Date de l'événement / signalement
2024-07-01
Stade de la preuve
Capacité techniqueUne démonstration, un référentiel ou un article montre que la tâche peut être faite. Cela met à jour ce que la technologie sait faire — pas ce que les employeurs feront.
Tâches concernées
Écrire de la fiction et des livres
Rédiger des romans, des nouvelles et des livres documentaires.
Augmentée≈ Estimation de la plateforme
Où ceci s'applique
Un concours entre le romancier Patricio Pron et GPT-4 Turbo écrivant des nouvelles à partir des mêmes titres, évaluées par des critiques et des universitaires spécialistes de littérature en anglais et en espagnol. Les auteurs indiquent que les modèles de langage sont encore loin de rivaliser avec un grand écrivain de création humain, et que GPT-4 a écrit de manière plus créative avec les titres du romancier qu'avec les siens. L'étude compare un auteur et un modèle.
Ce que cela veut dire
Au sommet du métier, un romancier a encore nettement battu le modèle — et le modèle a fait mieux avec les idées du romancier qu'avec les siennes.
Ce que cela ne montre pas encore
Un romancier face à un modèle de 2024 ; cela ne dit rien des écrivains moyens ni des modèles plus récents.
Ce que vous pouvez vérifier
Ouvrez l'article arXiv « Pron vs Prompt » (2407.01119) et cherchez « still far from challenging a top human creative writer ».
Cela change-t-il l'évaluation ?
Non — et ce stade ne le déplace pas non plus. Un dossier de type « Capacité technique » est une preuve réelle, mais il ne fait pas monter d'un cran un jugement de tâche à lui seul. 1 jugement lié ci-dessus reste là où il était.
Source
Marco, Gonzalo, Mateo and del Castillo (UNED and Universidad Complutense de Madrid) — Pron vs Prompt: Can Large Language Models already Challenge a World-Class Fiction Author at Creative Text Writing?, arXiv:2407.01119 (EMNLP 2024; submitted 1 Jul 2024) · vérifié 2026-09-30 · Claude (VOLO agent) · interprété 2026-09-30 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.