PiloteAutomatisation cognitive2024-08-23
Le Trésor australien a constaté que le personnel participant à son essai de Copilot de 14 semaines utilisait l'outil moins que prévu, en invoquant des attentes initiales élevées, des limites technologiques et un manque d'accompagnement et de formation
Responsable des systèmes de gestionpage du métier →Date de l'événement / signalement
2024-08-23 · signalé 2025-02-05
Stade de la preuve
PiloteEssai à petite échelle dans un cadre réel. Cela nous dit que les conditions de déploiement sont mises à l'épreuve, non qu'elles sont réunies — donc un pilote ne suffit jamais à lui seul ; deux indépendants suffisent.
Tâches concernées
Faire que l'équipe s'en serve correctement
Former, répondre pour la cinquième fois à la même question, et découvrir que la raison pour laquelle un champ est toujours vide est que le remplir coûte à quelqu'un vingt secondes qu'il n'a pas.
Encore menée par des humains✓ Appuyé sur des preuves
Où ceci s'applique
L'unité d'évaluation interne du Trésor, rendant compte d'un essai de Microsoft 365 Copilot par 218 membres du personnel du 20 mai au 23 août 2024, dans le cadre d'un essai du gouvernement australien. Elle indique que le produit a été moins utilisé que prévu initialement, environ un quart des participants s'en servant fréquemment à la fin ; que cet usage moindre tenait probablement à des attentes initiales élevées qui se sont amenuisées à l'usage, à des limites technologiques et à un manque d'accompagnement et de formation à l'utilisation du produit ; et que 42 participants se sont portés volontaires comme référents de l'essai, chargés d'accompagner leurs équipes. Les constats reposent sur des enquêtes (136 réponses après l'essai) et des groupes de discussion. Il s'agit d'un assistant d'IA bureautique dans un ministère chargé d'élaborer des politiques publiques, non d'un CRM ni d'un système de gestion des commandes.
Ce que cela veut dire
Un second essai gouvernemental, dans un autre pays, a trouvé la même chose : les gens ont utilisé l'assistant moins que prévu, et une partie de la raison avancée est que personne ne leur avait appris à s'en servir. Faire qu'une équipe utilise correctement un nouveau système reste un travail que quelqu'un doit faire.
Ce que cela ne montre pas encore
Un petit essai dans un seul ministère chargé d'élaborer des politiques publiques, fondé sur des enquêtes ; cela ne montre pas comment se passent les déploiements de CRM ou de systèmes de gestion des commandes, ni si ces raisons valent ailleurs.
Ce que vous pouvez vérifier
Ouvrez « Evaluation of a trial of generative artificial intelligence (Copilot) » du Trésor et cherchez « a lack of education and training on how to use the product ».
Cela change-t-il l'évaluation ?
Non. L'indice d'impact n'est jamais déplacé par un seul événement, et ce stade n'en déplace pas un à lui seul : un dossier de type « Pilote » compte vers un jugement mais exige un second dossier indépendant avant que le jugement ne repose sur des preuves. Celui-ci est compté ; à lui seul il n'a rien changé.
Source
Australian Centre for Evaluation, Department of the Treasury — "Evaluation of a trial of generative artificial intelligence (Copilot) in The Department of the Treasury" (evaluation report, February 2025) · vérifié 2026-09-28 · Claude (VOLO agent) · interprété 2026-09-28 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.