Impulsion réglementaireAutomatisation cognitive2025-04-03
Au titre du mémorandum M-25-21 de l'OMB, les agences fédérales américaines doivent tester l'IA à fort impact avant son déploiement — en interrogeant le service et en observant ses sorties si elles n'ont pas le modèle — et continuer à la tester ensuite
Testeur logiciel / ingénieur qualitépage du métier →Date de l'événement / signalement
2025-04-03
Stade de la preuve
Impulsion réglementaireUne réglementation, une subvention ou une commande publique exige ou finance l'adoption — le miroir d'une contrainte. Cela montre que l'adoption est exigée, non qu'elle a eu lieu, donc une impulsion ne suffit jamais à elle seule ; deux indépendantes suffisent.
Tâches concernées
Tester des systèmes avec un modèle dedans
Évaluer un logiciel dont la sortie n'est pas déterministe — bâtir des jeux d'évaluation, attraper les régressions de comportement, tester les sorties nuisibles.
Nouvelle tâche✓ Appuyé sur des preuves
Où ceci s'applique
Un mémorandum fédéral qui s'impose aux agences de l'exécutif américain. Parmi les pratiques minimales de gestion des risques pour l'IA à fort impact, les agences doivent élaborer des plans de tests avant déploiement et d'atténuation des risques qui reflètent les résultats attendus en conditions réelles ; lorsqu'elles ne peuvent pas accéder au code source, aux modèles ou aux données, elles doivent recourir à d'autres méthodes de test, comme interroger le service d'IA et observer ses sorties ou fournir des données d'évaluation au fournisseur ; et, après le déploiement, elles doivent mener des tests et un examen humain périodique des cas d'usage de l'IA lorsque c'est faisable. Il lie les agences, non les testeurs nommément, et ne couvre que les usages à fort impact.
Ce que cela veut dire
Pour l'IA à fort impact utilisée par l'administration, tester le comportement du modèle avant et après le déploiement est désormais une exigence écrite — y compris le test en boîte noire qui consiste à interroger un service et à vérifier ce qu'il renvoie. C'est exactement le travail de test nouveau que décrit cette tâche.
Ce que cela ne montre pas encore
La règle d'un seul gouvernement pour ses propres agences ; cela ne montre ni qui fait les tests, ni avec quelle qualité.
Ce que vous pouvez vérifier
Ouvrez le mémorandum M-25-21 de l'OMB et cherchez « Agencies must develop pre-deployment testing ».
Cela change-t-il l'évaluation ?
Non. L'indice d'impact n'est jamais déplacé par un seul événement. Ce dossier n'a pas non plus changé de couche : les 1 jugement lié ci-dessus reposaient déjà sur des preuves antérieures. Celui-ci s'y ajoute.
Source
US Office of Management and Budget — Memorandum M-25-21, Accelerating Federal Use of AI through Innovation, Governance, and Public Trust (April 3, 2025), section 4(b), minimum risk management practices · vérifié 2026-09-27 · Claude (VOLO agent) · interprété 2026-09-27 · Claude (VOLO agent)
Source primaire — publiée par la partie qui a fait la chose, ou par l'autorité de référence. Aucune contresignature nécessaire.