essay

Deixe o agente fazer o que puder desfazer

Jeff Reynar
Deixe o agente fazer o que puder desfazer

Peça a um assistente para encontrar um restaurante com mesa livre na quinta e ele volta com três opções. Peça ao mesmo assistente para reservar uma, e ele reserva, mas às vezes a reserva vem com uma taxa de cancelamento. Os dois pedidos soam quase idênticos. Um deles pode custar dinheiro.

A maior parte do setor discute essa fronteira em termos de autonomia. Níveis de autonomia, graus de supervisão, humano no circuito. Muitos termos para um único espectro que vai de “pede permissão para tudo” a “simplesmente resolve”, e cada equipe é chamada a decidir onde ajustar o dial com base em quanto confia no modelo.

Confiança não é a dimensão certa aqui, porque é um julgamento sobre um sistema que muda debaixo dos seus pés a cada poucos meses, e às vezes de uma consulta para outra. Você não consegue quantificar essa confiança, e mesmo que conseguisse, o que faria com um nível de confiança de 73%?

Faça uma pergunta diferente

Essa ação pode ser desfeita?

Essa é uma propriedade da ação, não do modelo. Ela não muda quando o modelo melhora. Duas pessoas geralmente concordam com a resposta, e você pode anotá-la de antemão. É a pergunta da Amazon sobre portas de mão única versus portas de mão dupla, aplicada a agentes em vez de decisões de negócio.

Rascunhar uma resposta é reversível. O rascunho fica esperando para ser enviado, e você decide se envia ou não. Enviar a resposta automaticamente não é reversível: a outra pessoa a recebe e pode já tê-la lido antes que você perceba que foi enviada. Isso faz com que uma retratação seja uma segunda mensagem, não um desfazer. Adicionar uma página a uma base de conhecimento é reversível, porque existe um histórico de versões e um estado anterior para voltar. Reservar uma mesa que cobra por cancelamento não é totalmente reversível, porque desfazer isso custa dinheiro. Pagar uma fatura não é, pelo menos não facilmente. É mais parecido com enviar o e-mail. Criar uma tarefa é reversível. Excluir uma pode ser, dependendo de haver um backup.

Separe as ações do seu agente nessas duas pilhas, e a maior parte da discussão sobre autonomia perde importância. A pilha reversível pode rodar sem supervisão, porque recuperar-se de um erro é notar e clicar em desfazer. A pilha irreversível precisa da atenção de uma pessoa, não porque o agente seja pouco confiável, mas porque não há desfazer para recorrer quando ele erra. Esse não é um filtro perfeito, porque você não quer gastar horas desfazendo ações do agente que são ruins mas reversíveis, mas isso é mais uma questão de qualidade do que de confiança.

É isso que a maioria das equipes está deixando passar

A Deloitte entrevistou 3.235 líderes de TI e de negócios em 24 países para seu relatório State of AI in the Enterprise 2026. Apenas 21% dizem ter um modelo de governança maduro para IA agêntica, e o que falta aos outros 79% é descrito de forma específica: fronteiras claras definindo quais decisões um agente pode tomar de forma independente versus quais exigem aprovação humana, monitoramento que sinaliza anomalias, e trilhas de auditoria.

O primeiro item dessa lista é a pergunta sobre reversibilidade, feita uma vez para cada tipo de ação e registrada por escrito. É o mais fácil dos três de resolver, e o que evita as piores falhas.

A mesma pesquisa mostra 74% esperando pelo menos uso moderado de agentes até 2027. A curva de adoção está correndo à frente das fronteiras.

Por que reversibilidade vence limiares de confiança

A alternativa óbvia é deixar o agente agir quando estiver confiante e perguntar quando não estiver. Isso falha de uma forma específica: a confiança é mais alta justamente nas ações que parecem rotineiras, e uma ação parecer rotineira não tem nada a ver com se ela pode ser desfeita. Um agente pode estar extremamente confiante ao enviar um e-mail, mas ainda assim deveria perguntar.

Reversibilidade também dá a você algo para ajustar. Uma vez que a pilha está separada, a pergunta interessante passa a ser como mover ações da segunda pilha para a primeira tornando-as reversíveis, em vez de como se sentir confortável com o modelo fazendo-as. Um envio que avisa e depois espera uma hora dá tempo para você interromper. Uma compra que cria uma aprovação pendente em vez de uma cobrança é uma compra reversível. Projetar um desfazer costuma ser mais fácil do que projetar confiança.

Publicidade é o caso em que isso ficou claro para mim. Gasto de campanha é praticamente tão irreversível quanto dinheiro pode ser, mas o trabalho publicitário é incomumente verificável: os números dizem em poucos dias se está funcionando. Então um agente pode montar a campanha inteira, escrever o texto, definir a segmentação, dimensionar o orçamento. Nada disso é irreversível até que algo seja gasto. Coloque a aprovação no momento do gasto, e o agente pode fazer o trabalho sem interrupção até chegar ao limiar da irreversibilidade.

Meu ponto de vista

Eu construo software nessa categoria. Entregamos uma camada de conhecimento na qual agentes e Flows escrevem, e ela é semiautomática de propósito. Um Flow propõe uma atualização e uma pessoa aceita ou edita. O cliente decide por quanto tempo manter essa etapa de aprovação, e alguns podem encurtá-la depois de observar o funcionamento por tempo suficiente para confiar.

Eu defenderia esse design com base em reversibilidade, não em cautela. Escrever em uma página é reversível, então um cliente que quer isso automático pode ter isso automático. Agir fora do sistema, enviar, gastar, comprometer-se em nome de alguém, é onde a aprovação pertence, e pertence lá até que um modelo seja tão bom quanto uma pessoa, e talvez além disso. Ninguém, e provavelmente nada, é realmente perfeito.

Os casos que isso não resolve

Reversibilidade parcial. Você pode excluir a mensagem que enviou, e a pessoa ainda a leu. Reversível no sistema, não no mundo. Trate o mundo como o sistema de registro.

Ações cumulativas. Cada uma é desfazível, mas desfazer quatrocentas delas é um projeto. Uma ação reversível executada em velocidade de máquina se torna irreversível em algum ponto. Ninguém sabe exatamente onde essa linha está.

Reversível por quem. Uma ação que o agente pode desfazer, uma ação que você pode desfazer, e uma ação que exige um chamado de suporte são três coisas diferentes usando o mesmo rótulo.

Nenhum desses casos torna a pergunta pior do que aquela que ela substitui. “Isso pode ser desfeito, por quem, e com que rapidez” é uma conversa que uma equipe consegue terminar em uma tarde. “O quanto confiamos nisso” é uma conversa que nunca termina, e as equipes que a têm são os 79%.