Projeto-pilotoAutomatização cognitiva2026-03-16
As equipas de design do governo do Reino Unido testaram o GOV.UK Chat em piloto com mais de 10.000 utilizadores e 99 testes de usabilidade remotos, acrescentaram perguntas de esclarecimento e concluíram que as respostas em fluxo contínuo obrigavam a redesenhar salvaguardas de segurança
Designer de produto / UXpágina da profissão →Data do facto / publicação
2026-03-16
Categoria da prova
Projeto-pilotoEnsaio em pequena escala num contexto real. Diz-nos que as condições de implementação estão a ser testadas, não que se verificam, por isso um piloto nunca chega sozinho; dois independentes chegam.
Tarefas sobre as quais incide
Investigação e testes de usabilidade
Ver utilizadores a lutar com o produto, fazer entrevistas, ler a analítica e transformar o que viste numa decisão.
Aumentada pela máquina✓ Com prova
Desenhar para produtos não determinísticos
Dar forma a produtos cujo resultado varia — interfaces conversacionais, agentes, conteúdo gerado — onde o velho ofício de ecrã a ecrã não se aplica.
Tarefa nova✓ Com prova
Onde é que isto se aplica
O serviço digital do governo do Reino Unido a descrever o seu próprio produto. Ao longo de 18 meses, fez dois pilotos públicos do GOV.UK Chat, em que mais de 10.000 utilizadores fizeram 26.000 perguntas; introduziu perguntas de esclarecimento quando as perguntas dos utilizadores eram ambíguas, o que elevou para 88% a proporção de perguntas dentro do âmbito que recebem resposta; a apresentação das respostas em fluxo contínuo teve bons resultados nos testes com utilizadores, mas obriga a redesenhar algumas salvaguardas de segurança; e a investigação recorreu a métodos que incluíram 99 testes de usabilidade remotos e um estudo de diário com 30 horas de entrevistas em vídeo. É um piloto relatado pela equipa que o construiu; o assistente funciona com um modelo da Anthropic, a empresa que criou o modelo que escreveu este registo.
O que isto significa
Desenhar um assistente generativo acabou por exigir soluções de design novas — devolver uma pergunta de esclarecimento a quem pergunta, repensar a segurança de respostas que aparecem enquanto estão a ser escritas — e muita investigação com utilizadores reais. O trabalho de design cresceu em vez de encolher.
O que ainda não mostra
Um piloto governamental relatado pela própria equipa; não mostra como as equipas comerciais desenham ou testam funcionalidades de IA.
O que podes verificar
Abre a publicação do Inside GOV.UK de 16 de março de 2026 e procura «we conducted 99 remote usability tests».
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. Este registo também não mudou a camada de nada: os 2 juízos ligados em cima já se apoiavam em prova anterior. Este soma-se a ela.
Fonte
Government Digital Service — Inside GOV.UK blog, "5 things we learned testing GOV.UK Chat, an AI assistant for government" (Lead Product Manager, GOV.UK AI, and Lead User Researcher, GDS; posted 16 March 2026) · verificado 2026-09-28 · Claude (VOLO agent) · interpretado 2026-09-28 · Claude (VOLO agent)
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.