PiloteAutomatisation cognitive2026-03-16
Les designers du gouvernement britannique ont mené un pilote de GOV.UK Chat auprès de plus de 10 000 utilisateurs, avec 99 tests d'utilisabilité à distance, ont ajouté des questions de clarification, et ont constaté que l'affichage progressif des réponses obligeait à repenser des garde-fous de sécurité
Designer produit / UXpage du métier →Date de l'événement / signalement
2026-03-16
Stade de la preuve
PiloteEssai à petite échelle dans un cadre réel. Cela nous dit que les conditions de déploiement sont mises à l'épreuve, non qu'elles sont réunies — donc un pilote ne suffit jamais à lui seul ; deux indépendants suffisent.
Tâches concernées
Recherche et tests d'utilisabilité
Regarder des utilisateurs se heurter à des obstacles, mener des entretiens, lire les statistiques d'usage, et transformer ce que vous avez vu en décision.
Augmentée✓ Appuyé sur des preuves
Concevoir pour des produits non déterministes
Façonner des produits dont la sortie varie — interfaces conversationnelles, agents, contenu généré — là où l'artisanat écran par écran ne s'applique plus.
Nouvelle tâche✓ Appuyé sur des preuves
Où ceci s'applique
Le service numérique du gouvernement britannique décrivant son propre produit. Sur 18 mois, il a mené deux pilotes publics de GOV.UK Chat, au cours desquels plus de 10 000 utilisateurs ont posé 26 000 questions ; il a introduit des questions de clarification lorsque les questions des utilisateurs étaient ambiguës, ce qui a porté à 88 % le taux de réponse aux questions relevant du périmètre ; l'affichage progressif des réponses a été bien accueilli lors des tests utilisateurs mais exige de repenser certains garde-fous de sécurité ; et la recherche a eu recours à des méthodes comprenant 99 tests d'utilisabilité à distance et une étude par journal de bord comptant 30 heures d'entretiens vidéo. Il s'agit d'un pilote rapporté par l'équipe qui l'a construit ; l'assistant fonctionne sur un modèle d'Anthropic, l'entreprise qui a créé le modèle ayant rédigé cet enregistrement.
Ce que cela veut dire
Concevoir un assistant génératif s'est révélé exiger de nouveaux gestes de conception — poser une question de clarification à l'utilisateur, repenser la sécurité pour des réponses qui s'affichent pendant qu'elles s'écrivent — et beaucoup de recherche avec de vrais utilisateurs. Le travail de conception a grandi au lieu de rétrécir.
Ce que cela ne montre pas encore
Un pilote gouvernemental rapporté par sa propre équipe ; il ne montre pas comment les équipes du secteur privé conçoivent ou testent des fonctions d'IA.
Ce que vous pouvez vérifier
Ouvrez le billet d'Inside GOV.UK du 16 mars 2026 et cherchez « we conducted 99 remote usability tests ».
Cela change-t-il l'évaluation ?
Non. L'indice d'impact n'est jamais déplacé par un seul événement. Ce dossier n'a pas non plus changé de couche : les 2 jugements liés ci-dessus reposaient déjà sur des preuves antérieures. Celui-ci s'y ajoute.
Source
Government Digital Service — Inside GOV.UK blog, "5 things we learned testing GOV.UK Chat, an AI assistant for government" (Lead Product Manager, GOV.UK AI, and Lead User Researcher, GDS; posted 16 March 2026) · vérifié 2026-09-28 · Claude (VOLO agent) · interprété 2026-09-28 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.