Mandato normativoAutomatização cognitiva2025-04-03
As agências federais dos EUA têm de testar a IA de alto impacto antes da implantação ao abrigo do memorando M-25-21 do OMB — consultando o serviço e observando as saídas se não tiverem o modelo — e continuar a testar depois
Testador de software / engenheiro de QApágina da profissão →Data do facto / publicação
2025-04-03
Categoria da prova
Mandato normativoUma regulação, um subsídio ou uma compra pública estão a exigir ou a financiar a adoção: o espelho de uma restrição. Mostra que a adoção está a ser exigida, não que tenha acontecido, por isso um mandato nunca chega sozinho; dois independentes chegam.
Tarefas sobre as quais incide
Testar sistemas com um modelo lá dentro
Avaliar software cujo resultado não é determinístico — construir conjuntos de avaliação, apanhar regressões de comportamento, testar saídas nocivas.
Tarefa nova✓ Com prova
Onde é que isto se aplica
Um memorando federal que vincula as agências do executivo dos EUA. Entre as práticas mínimas de gestão de risco para IA de alto impacto, as agências têm de elaborar planos de testes prévios à implantação e de mitigação de riscos que reflitam os resultados esperados no mundo real; quando não conseguem aceder ao código-fonte, aos modelos ou aos dados, têm de usar métodos de teste alternativos, como consultar o serviço de IA e observar as saídas ou fornecer dados de avaliação ao fornecedor; e, depois da implantação, têm de realizar testes e uma revisão humana periódica dos casos de uso de IA, quando exequível. Vincula as agências, e não os testadores pelo nome, e só cobre usos de alto impacto.
O que isto significa
Para a IA de alto impacto usada pelo Estado, testar o comportamento do modelo antes e depois da implantação passou a ser um requisito escrito — incluindo os testes de caixa-preta que consistem em consultar um serviço e verificar o que volta. É exatamente o trabalho de testes novo que esta tarefa descreve.
O que ainda não mostra
A regra de um governo para as suas próprias agências; não mostra quem faz os testes nem com que qualidade.
O que podes verificar
Abre o memorando M-25-21 do OMB e procura «Agencies must develop pre-deployment testing».
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. Este registo também não mudou a camada de nada: os 1 juízo ligado em cima já se apoiavam em prova anterior. Este soma-se a ela.
Fonte
US Office of Management and Budget — Memorandum M-25-21, Accelerating Federal Use of AI through Innovation, Governance, and Public Trust (April 3, 2025), section 4(b), minimum risk management practices · verificado 2026-09-27 · Claude (VOLO agent) · interpretado 2026-09-27 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.