Prueba pilotoAutomatización cognitiva2024-08-23
El Tesoro de Australia concluyó que el personal de su prueba de Copilot de 14 semanas usó la herramienta menos de lo previsto, y lo atribuyó a unas expectativas iniciales altas, a limitaciones tecnológicas y a la falta de formación y capacitación
Responsable de sistemas de negociopágina de la ocupación →Fecha del hecho / publicación
2024-08-23 · publicado 2025-02-05
Categoría de la evidencia
Prueba pilotoEnsayo a pequeña escala en un entorno real. Nos dice que se están probando las condiciones de despliegue, no que se cumplan, así que un piloto nunca basta por sí solo; dos independientes sí.
Tareas sobre las que incide
Conseguir que el equipo lo use bien
Formar, responder la misma pregunta por quinta vez, y descubrir que la razón de que un campo esté siempre vacío es que rellenarlo le cuesta a alguien veinte segundos que no tiene.
Sigue llevándola una persona✓ Con evidencia
Dónde aplica esto
La unidad de evaluación interna del Tesoro, informando sobre una prueba de Microsoft 365 Copilot con 218 empleados del 20 de mayo al 23 de agosto de 2024, dentro de una prueba del Gobierno de Australia. Dice que el producto se usó menos de lo previsto en un principio, y que al final alrededor de una cuarta parte lo usaba con frecuencia; que el menor uso se debió probablemente a unas expectativas iniciales altas que se desinflaron en la práctica, a limitaciones tecnológicas y a la falta de formación y capacitación sobre cómo usar el producto; y que 42 participantes se ofrecieron por iniciativa propia como referentes de la prueba, con el encargo de apoyar a sus equipos. Las conclusiones se basan en encuestas (136 respuestas tras la prueba) y grupos focales. Es un asistente de IA de ofimática en un departamento de políticas públicas, no un CRM ni un sistema de pedidos.
Qué significa esto
Una segunda prueba pública, en otro país, encontró lo mismo: la gente usó el asistente menos de lo planeado, y parte del motivo que se dio fue que nadie les había enseñado a usarlo. Conseguir que un equipo use bien un sistema nuevo sigue siendo un trabajo que alguien tiene que hacer.
Qué no muestra todavía
Una prueba pequeña en un solo departamento de políticas públicas, basada en encuestas; no muestra cómo van los despliegues de CRM o de sistemas de pedidos, ni si estos motivos se sostienen en otros sitios.
Qué puedes comprobar
Abre la «Evaluation of a trial of generative artificial intelligence (Copilot)» del Tesoro y busca «a lack of education and training on how to use the product».
¿Cambia la evaluación?
No. El índice de impacto no lo mueve nunca un solo hecho, y esta categoría no mueve uno por sí sola: un registro de «Prueba piloto» cuenta para un juicio pero necesita un segundo registro independiente antes de que el juicio se apoye en evidencia. Este está contado; por sí solo no cambió nada.
Fuente
Australian Centre for Evaluation, Department of the Treasury — "Evaluation of a trial of generative artificial intelligence (Copilot) in The Department of the Treasury" (evaluation report, February 2025) · verificado 2026-09-28 · Claude (VOLO agent) · interpretado 2026-09-28 · Claude (VOLO agent)
Fuente primaria: publicada por la parte que hizo esto, o por la autoridad de referencia. No necesita cofirma.