Resposta direta

Se a IA pode clicar em comprar, mandar email e apagar arquivos, quem segura o cartão vermelho? Essa pergunta ficou urgente porque os agentes deixaram de apenas responder. Agora eles usam navegador, terminal, arquivos e aplicativos.

Se a IA pode clicar em comprar, mandar email e apagar arquivos, quem segura o cartão vermelho?

Capa estilo caderno Moleskine mostrando uma mão humana segurando um cartão vermelho diante de um pequeno robô de IA

Essa pergunta ficou urgente porque os agentes deixaram de apenas responder. Agora eles usam navegador, terminal, arquivos e aplicativos. Eles conseguem preparar um trabalho e também mudar coisas no mundo real.

Pense simples: aprovação humana é a pausa em que a IA mostra o que pretende fazer e espera uma pessoa dizer “sim” ou “não”.

TL;DR

  • A IA pode pesquisar, organizar e preparar muita coisa sozinha.

  • Antes de uma ação difícil de desfazer, ela deve parar e pedir confirmação.

  • Eu colocaria aprovação humana antes de enviar, comprar, apagar, publicar e mudar dados importantes.

  • Aprovação boa mostra ação, destino, impacto e botão claro de confirmar.

A analogia do sinal vermelho

Imagine um cruzamento.

O carro pode ter motor, mapa e motorista. Mesmo assim, existe um sinal vermelho no ponto em que outro carro pode atravessar.

A aprovação humana faz esse papel para o agente.

Ela não aparece em toda curva. Isso deixaria a viagem lenta. Ela aparece no ponto em que um erro pode atingir um cliente, gastar dinheiro, expor um segredo ou apagar algo importante.

O agente chega ao cruzamento e diz:

Estou pronto para enviar este email para 420 clientes.
Assunto: Nova condição comercial
Quer revisar e confirmar o envio?

Uma pessoa olha o destino, o conteúdo e o tamanho do impacto. Só então libera a ação.

Por que isso está em alta

A OpenAI explica que o ChatGPT agent pede confirmação antes de ações que mudam o mundo, como concluir uma compra ou enviar um email. A empresa também permite configurar agentes de trabalho para exigir confirmação em ações de escrita.

O GitHub aplica uma ideia parecida: um agente pode criar código e abrir um pull request, mas uma pessoa precisa revisar e fazer o merge. O agente prepara; o humano assume a responsabilidade no ponto decisivo.

Isso não é falta de confiança na IA. É desenho de processo.

Uma calculadora também pode errar quando recebe o número errado. A diferença é que um agente consegue levar o erro até um aplicativo real.

Onde eu colocaria o sinal vermelho

1. Antes de enviar uma mensagem

Email, WhatsApp, post social e proposta comercial saem da empresa e chegam a outra pessoa.

O agente pode escrever, revisar ortografia e preparar os destinatários. Antes do envio, eu quero ver o texto final e quem vai receber.

2. Antes de gastar dinheiro

Comprar produto, aumentar orçamento de anúncio ou contratar uma ferramenta pede confirmação.

O pedido deve mostrar valor, fornecedor e motivo. “Deseja continuar?” sozinho é pouco.

3. Antes de apagar ou substituir

Excluir arquivo, remover cliente do CRM e trocar uma versão publicada podem ser difíceis de desfazer.

Eu prefiro que o agente prepare a mudança, mostre o que será afetado e ofereça uma opção segura, como arquivar em vez de apagar.

4. Antes de publicar

Um texto local ainda pode ser corrigido sem plateia. Um texto público já representa a marca.

O agente pode montar o artigo, gerar a imagem e rodar testes. A publicação entra depois da revisão quando o fluxo exige decisão editorial.

5. Antes de mudar acesso ou dados sensíveis

Dar permissão, compartilhar uma pasta, alterar preço e mexer em contrato merecem uma pausa maior.

Nesses casos, não basta qualquer pessoa clicar. A aprovação precisa vir de quem realmente tem autoridade.

Um exemplo prático

Imagine um agente que cuida das cobranças de uma escola.

Ele encontra 30 mensalidades atrasadas, confere os nomes e prepara mensagens educadas.

Um fluxo perigoso seria:

Encontrar atrasos → escrever mensagens → enviar tudo

Eu desenharia assim:

Encontrar atrasos
→ separar casos duvidosos
→ preparar mensagens
→ mostrar lista, texto e total de destinatários
→ pessoa aprova
→ enviar
→ guardar recibo do envio

O agente faz o trabalho pesado. A pessoa decide no momento em que a empresa fala com 30 famílias.

Como criar uma aprovação que presta

Uma caixa genérica com “confirmar” não ajuda muito. A pessoa pode clicar no automático.

Uma boa aprovação responde quatro perguntas:

  • O quê? A ação exata que será executada.

  • Onde? O aplicativo, arquivo ou público afetado.

  • Quanto? O número de pessoas, registros ou reais envolvidos.

  • Dá para voltar? O que acontece se estiver errado.

Exemplo ruim:

O agente precisa de aprovação. Continuar?

Exemplo melhor:

Publicar o artigo “Aprovação humana em agentes de IA”
em gustavocaetano.com agora?
A página ficará pública e entrará no sitemap e no feed.

Aprovar tudo também é um erro

Se a IA pede autorização para abrir cada arquivo, fazer cada conta e corrigir cada vírgula, a pessoa vira um botão cansado.

Isso cria fadiga de aprovação. Depois de vinte avisos pequenos, alguém confirma o aviso importante sem ler.

Minha regra é simples:

  • leitura e preparação de baixo risco podem seguir;

  • ação externa, dinheiro, exclusão e dado sensível pedem pausa;

  • quanto maior o impacto, mais clara e mais autorizada deve ser a aprovação.

O objetivo não é colocar uma pessoa no meio de todas as etapas. É colocar a pessoa no ponto certo.

Aprovação, hook e permissão são diferentes

  • permissão define o que o agente consegue acessar;

  • hook dispara uma regra quando um evento acontece;

  • aprovação humana pede uma decisão antes da ação;

  • log guarda o recibo do que foi feito.

Os quatro trabalham juntos. Uma permissão curta diminui o alcance. Um hook percebe que a ação é sensível. A pessoa aprova. O log registra o resultado.

Perguntas rápidas

O que é aprovação humana em agentes de IA?

É uma pausa obrigatória antes de uma ação importante. O agente mostra o que pretende fazer e espera uma pessoa autorizar ou recusar.

Toda ação do agente precisa de aprovação?

Não. Tarefas de leitura, organização e preparação podem seguir sozinhas quando têm baixo risco. A pausa deve ficar nos pontos de maior impacto.

Quais ações sempre deveriam pedir confirmação?

Eu priorizaria envio externo, compra, exclusão, publicação, mudança de preço, alteração de acesso e uso de dados sensíveis.

A aprovação humana elimina erros?

Não. Ela reduz a chance de um erro virar ação real. A pessoa ainda precisa receber informação clara e prestar atenção antes de confirmar.

Quem deve aprovar?

Quem tem responsabilidade e contexto para aquela decisão. Um contrato deve ir ao responsável pelo contrato; uma campanha paga, a quem controla o orçamento.

Como começar hoje?

Escolha um fluxo com ação externa, marque a última etapa reversível e coloque a confirmação logo antes dela. Mostre ação, destino, impacto e possibilidade de desfazer.

Conclusão

Agente bom não é o que nunca chama uma pessoa.

É o que faz sozinho o trabalho repetitivo e chama a pessoa quando a decisão tem consequência.

A aprovação humana é esse sinal vermelho: uma pausa curta que protege dinheiro, dados, clientes e reputação.

Se o seu agente já usa ferramentas, faça uma pergunta hoje: qual clique dele eu não gostaria de descobrir só depois? Coloque a aprovação imediatamente antes desse clique.

Para continuar, leia também [o que são hooks de agentes de IA](/blog/o-que-sao-hooks-de-agentes-de-ia), [o que é sandbox de agentes](/blog/o-que-e-sandbox-de-agentes-de-ia) e [GPT-Red: 4 testes antes de soltar um agente](/blog/o-que-e-gpt-red).

Fontes que eu li