Implementação realAutomatização cognitiva2026-05-28
Dois engenheiros da Google descreveram os agentes que a sua própria organização de SRE tem em funcionamento na resposta a incidentes: agrupamento de alertas, documentos de passagem de turno, rascunhos de postmortem e, nalguns casos, mitigação autónoma
Engenheiro de DevOps / plataforma / SREpágina da profissão →Data do facto / publicação
2026-05-28
Categoria da prova
Implementação realUma empresa pô-lo em produção. Pode mover a linha de base, ponderado pela escala e por quanto esse contexto se parece com o teu.
Tarefas sobre as quais incide
Ser acordado
Decidir às três da manhã, com pressa e com informação parcial, o que se reverte, o que se degrada e o que se diz às pessoas enquanto ainda está partido.
Continua a ser levada por uma pessoa✓ Com prova
Onde é que isto se aplica
A Google a descrever as suas próprias operações e não a vender a outrem: assinam um Distinguished Software Engineer e um Distinguished Site Reliability Engineer, e sai no blogue da empresa. O que afirma no passado ou no presente é a metade que merece ser registada: a equipa de SRE desenvolveu agentes que vigiam e melhoram os playbooks e a documentação de produção a partir da sua utilização durante os incidentes, e que conseguem gerar playbooks novos a partir deles; um agente de alertas que as agrupa, pré-processa e enriquece antes de serem entregues a tratadores autónomos; agentes que consolidam os espaços de conversa, os vídeos e os documentos de acompanhamento usados durante um incidente, criam documentos de passagem entre SRE, redigem rascunhos de postmortem e gerem a comunicação interna e externa do incidente; agentes criados para investigar incidentes e, nas palavras do texto, nalguns casos para os mitigar de forma autónoma; e o AI Insights, um sistema que revê incidentes passados e devolve o que extrai a esses agentes. O resto do texto são planos e não é registado. Três limites, e o primeiro é o maior. Não há um único número: nem que proporção de incidentes tocam, nem quantos agentes estão a correr, nem um antes e um depois, nem quanta gente está hoje na escala. Segundo, o interesse é directo e o enquadramento na primeira pessoa não o esconde: cada componente citado por baixo é um produto da Google (Gemini, o Agent Development Kit, a Gemini Enterprise Agent Platform, MCP sobre a infra-estrutura de API da Google), pelo que o texto é também uma arquitectura de referência daquilo que o editor vende. Terceiro, é um único operador, e pouco comum: uma organização com vinte anos de disciplina própria de fiabilidade não substitui uma equipa de quatro a revezar-se no pager. O que faz disto prova sobre esta tarefa e não sobre ferramentas é onde os agentes se sentam: o trabalho à volta da decisão das três da manhã — reunir o contexto, passar o turno, dizer às pessoas o que se passa, escrever depois — é a parte que se moveu, e o texto diz que uma abordagem com agentes não implica necessariamente tirar as pessoas do processo nos serviços de maior risco.
O que isto significa
Num operador muito grande, as partes de um incidente das três da manhã que passaram primeiro para software são as que rodeiam a decisão e não a decisão em si: reunir o contexto, agrupar os alertas, passar ao engenheiro seguinte, dizer o que se está a passar e escrever depois. O texto diz ainda que os agentes nalguns casos mitigam de forma autónoma, e que nos serviços de maior risco a abordagem não tira necessariamente as pessoas.
O que ainda não mostra
Não há um único número no texto. Não diz que proporção de incidentes estes agentes tocam, quantos estão a correr, o que mudou antes e depois, nem quanta gente está agora na escala. Também não diz se alguém é acordado menos vezes, que é a pergunta de que esta tarefa trata verdadeiramente.
O que podes verificar
Veja os seus três últimos incidentes e marque que minutos foram para perceber o que se passava, quais para decidir e quais para contar às pessoas. O primeiro e o terceiro são as partes que este empregador entregou; o segundo é a que diz ter ficado. Se a sua divisão não se parece nada com isto, o registo não se transfere para si, e isso também vale a pena saber.
Muda a avaliação?
Não. O índice de impacto nunca é movido por um único facto. O que este registo fez: 1 juízo de tarefa ligado em cima apoiam-se agora em prova em vez de em inferência.
Fonte
Google Cloud — Stevan Malesevic and Christopher Heiser, AI in SRE: where and how Google is deploying agentic AI to improve operations (28 May 2026) · verificado 2026-09-22 · VOLO agent · interpretado 2026-09-22 · VOLO agent
Fonte primária: publicada pela parte que fez isto, ou pela autoridade de referência. Não precisa de coassinatura.