A Next Insurance Manteve Sprints e Quadro. Mudou Quem Escreve Cada Artefato.

TV
Thiago Victorino
8 min de leitura
A Next Insurance Manteve Sprints e Quadro. Mudou Quem Escreve Cada Artefato.

Uma seguradora de cerca de duzentas pessoas passou três ou quatro meses colocando um ciclo de desenvolvimento agêntico em produção. Segundo o relato de Yuval Yeret de uma conversa com Shay Mandel, que lidera produto e habilitação de IA na Next Insurance, a empresa manteve o planejamento trimestral, manteve os sprints e manteve o quadro. O que mudou foi quem escreve os artefatos. PRDs, designs, código, revisões: agentes produzem tudo isso, guiados por skills que a empresa mantém, e uma lista curta de decisões continua com pessoas.

A implantação roda em poucos squads até agora. É um caso único, relatado em segunda mão, e eu o trato assim. Ele merece oito minutos porque é a decisão de sequenciamento mais clara que já vi escrita: mude a autoria primeiro, segure o processo parado e deixe o processo avisar quando precisar mudar.

Duas variáveis, um experimento

Tudo numa implantação agêntica convida a um redesenho. Sprints parecem lentos quando um agente rascunha um PRD mais rápido do que o sprint consegue absorver. Dailies parecem inúteis quando um pipeline atualiza o quadro. A lista de cerimônias pede para ser reescrita.

A Next Insurance deixou a lista em paz. Mesma cadência, mesmo quadro, mesmo ritmo de planejamento. Minha leitura do porquê: higiene experimental. Se você muda quem produz os artefatos e como o time se coordena no mesmo trimestre, uma queda na entrega tem duas causas candidatas e você é incapaz de separá-las. Segure o processo e a única variável em movimento é a autoria. Quando algo quebra, você sabe onde olhar.

O processo vai mudar em algum momento, e o gatilho é observável: o instante em que o quadro para de dizer onde o trabalho está. Em a fronteira de escalonamento é o artefato, a passagem entre agente e humano era um documento escrito. Aqui a passagem é um estado no Kanban, e esse estado alimenta as mesmas métricas de fluxo que o time já lê. Quando uma coluna deixa de descrever o que os agentes estão fazendo, essa coluna é a primeira coisa a redesenhar. Até lá o quadro cumpre sua função, que é manter o fluxo visível enquanto a autoria muda por baixo.

As cinco decisões que ficam com humanos

A coisa mais útil no texto de Yeret é uma lista. Cinco decisões continuam com pessoas na Next Insurance:

  1. Prioridades e seleção de funcionalidades.
  2. Aprovação do PRD.
  3. Revisão do design técnico antes de qualquer código ser escrito.
  4. Um olhar humano no pull request depois que a revisão do agente disse OK.
  5. A chave manual sobre os resultados de testes A/B.

Agentes rascunham todo o resto. Observe onde as cinco estão. Cada uma é um portão numa transição, e cada uma é o ponto em que uma resposta errada custa caro para reverter. Escolher a funcionalidade errada se mede em trimestres. Aprovar um PRD errado se mede em sprints. Um design errado custa o código escrito em cima dele. Um merge errado custa um rollback. Uma decisão errada de A/B custa um resultado visível ao cliente. O humano em cada item aprova ou aciona a chave; o rascunho saiu da lista por completo.

Já defendemos que especificações são artefatos de governança. Este caso é a versão disso numa empresa com lista publicada. A lista cabe num slide e é específica o bastante para auditar. Pergunte a um líder de engenharia quais decisões no pipeline agêntico dele ainda exigem uma pessoa e, nas conversas que tenho, a resposta habitual é uma sensação. A Next Insurance entrega cinco linhas.

Sessenta por cento é o plano

A gestão de expectativas de Mandel é incomum pela precisão: “a versão inicial provavelmente vai ter sessenta ou setenta por cento de acerto. E provavelmente chegaremos a noventa ou noventa e cinco por cento. E os cinco por cento extras são o motivo de precisarmos de um humano no circuito.”

Três coisas decorrem disso. A primeira versão está planejada para errar cerca de um terço das vezes. Os últimos cinco por cento são a justificativa de design para os portões humanos. E a lista de cinco decisões foi dimensionada para esses cinco por cento: uma empresa que espera agentes certos em dezenove de vinte respostas coloca pessoas onde a vigésima resposta doeria mais.

Revisão por exceção era uma proposta quando escrevemos: uma máquina lê tudo, uma pessoa lê o que a máquina sinaliza. O relato de Yeret nomeia uma skill de revisão de PRD pela engenharia. Coloque essa skill ao lado da segunda decisão humana, a aprovação do PRD, e o formato é o que descrevemos, rodando em produção numa seguradora. Um agente produz a revisão. Uma pessoa é dona da aprovação.

Um usuário por skill é um modo de falha

O relato nomeia um antipadrão visto em outras empresas: “cada skill é usada por talvez um ou dois usuários.” A resposta que dá: “todo mundo deveria melhorar o cérebro que temos na empresa.”

Se agentes escrevem os artefatos, as skills que os guiam são o processo da empresa em forma executável. Uma skill usada por uma pessoa é um processo privado. Vinte dessas e você tem vinte jeitos de escrever um PRD, cada um derivando sozinho. Proliferação de skills é proliferação de processo com controle de versão acoplado.

O remédio que o relato descreve é organizacional: skills são ativos compartilhados, e todo mundo as melhora. A forma concreta que eu daria a isso: um repositório, muitos contribuidores, revisão a cada mudança. Uma empresa que deixa cada squad guardar os próprios prompts fez a troca de autoria e jogou fora a governança que essa troca deveria comprar.

Produto e engenharia estão atrasados

Um detalhe de sequenciamento contraria a história habitual. Na Next Insurance, sinistros, suporte e a área voltada ao cliente adotaram IA há cerca de um ano. Produto e engenharia estão, nas palavras do relato, “na verdade atrasados”.

Times de engenharia costumam assumir que lideram porque construíram as ferramentas. Minha leitura deste caso: as funções que se moveram primeiro tinham artefatos com donos claros e limiares de acerto claros. Engenharia carrega uma cadeia mais densa de passagens (PRD, design, código, revisão, release), e levou mais tempo para decidir quais decisões humanas manter. Escrevemos sobre o que código escrito por agentes faz com a gestão de produto. A lista da Next Insurance é uma resposta: uma pessoa fica com as prioridades e a aprovação do PRD, e abre mão do rascunho.

Saber que precisa da ferramenta é a parte difícil

Benedict Evans, escrevendo no mesmo mês, enquadra o problema de fora da empresa. “A parte difícil é saber que você precisa de uma ferramenta para isso em primeiro lugar, e depois saber o que a ferramenta deveria fazer.” Uma ferramenta que toca “50 ou 500 pessoas em cinco departamentos diferentes, três sistemas de registro diferentes e quatro regimes regulatórios diferentes” “tem que ser uma compra, e uma decisão, e um processo de venda de 18 meses”.

Evans está explicando por que a transformação corporativa é lenta. A lista da Next Insurance responde à segunda pergunta dele, o que a ferramenta deveria fazer. Quando a empresa sabe quais decisões ficam com humanos, o ciclo agêntico ganha uma especificação: todo o resto. Antes dessa lista existir, “adotar IA na engenharia” é um desejo com orçamento.

Evans também diz que cerca de metade dos pilotos falha, e acrescenta que isso é normal e é o propósito de um piloto. Esse número é uma estimativa dele, sem fonte, e eu o cito como opinião. Ele combina com o modelo de Mandel. Um piloto que espera sessenta por cento de acerto e planeja os portões humanos em torno da diferença foi construído para sobreviver errando com frequência. Um piloto que espera noventa e cinco por cento no primeiro dia foi construído para ser cancelado.

Faça isso agora

Escreva sua lista antes de mudar qualquer outra coisa.

  1. Levante o inventário de artefatos de um squad: PRDs, designs, pull requests, planos de teste, notas de release, atualizações do quadro. Marque quem escreve cada um hoje.
  2. Para cada transição entre artefatos, decida se uma pessoa aprova, revisa ou está ausente. A Next Insurance tem cinco itens. A sua pode ter quatro ou sete. A contagem importa menos do que o fato de estar escrita e ser auditável.
  3. Segure as cerimônias paradas durante o período. Mesma duração de sprint, mesmo quadro, mesmo planejamento. Observe o quadro. No dia em que ele parar de dizer onde o trabalho está, você tem sua primeira mudança de processo, e vai saber por que a está fazendo.
  4. Coloque as skills num lugar só, com um dono por skill e um registro de mudanças. Uma skill com um usuário entra numa lista para adoção ou remoção.
  5. Escreva a expectativa de acerto. Sessenta a setenta agora, noventa a noventa e cinco depois. O resíduo é a razão de a lista do passo 2 existir.

Autoria primeiro, processo depois, e uma lista escrita do que fica com humanos entre os dois.


Fontes

A Victorino ajuda organizações de engenharia a decidir quais decisões ficam com humanos antes de os agentes assumirem os artefatos: contato@victorino.com.br | www.victorino.com.br

Todos os artigos do The Thinking Wire são escritos com o auxílio do modelo LLM Opus da Anthropic. Cada publicação passa por pesquisa multi-agente para verificar fatos e identificar contradições, seguida de revisão e aprovação humana antes da publicação. Se você encontrar alguma informação imprecisa ou deseja entrar em contato com o editorial, escreva para editorial@victorino.com.br . Sobre o The Thinking Wire →

Se isso faz sentido, vamos conversar

Ajudamos empresas a implementar IA sem perder o controle.

Agendar uma Conversa