O que é um agente de IA, explicado sem jargão
A OpenAI publicou um guia sobre agentes. Reescrevi em português simples: o que o agente faz, quando não vale a pena e o que conferir antes de soltar.
A OpenAI publicou um guia prático para quem quer construir o primeiro agente. O texto vem cheio de diagrama e nome de ferramenta. O essencial cabe em duas frases: agente é um sistema que faz a tarefa por você, e ele só funciona com três coisas — cérebro, ferramenta e manual — mais alguém conferindo o resultado.
Eu reescrevi do jeito que eu explicaria para uma criança de 10 anos. Sem perder o que importa, e com minha leitura no final.
Em 20 segundos
O guia inteiro em quatro cartões
O que é
Um agente faz a tarefa inteira por você: começa, escolhe o próximo passo, usa a ferramenta certa e entrega o resultado.
O que não é
Chat que só responde pergunta. Usar IA não transforma nada em agente.
Quando vale
Quando a tarefa tem regra demais, exceção demais ou texto que regra não lê.
Quando não vale
Quando uma regra simples já resolve. Para o guia, aí não entra agente.
Agente é quem faz a tarefa inteira
Software comum deixa você fazer. O agente faz por você.
O guia dá exemplos de tarefa: resolver reclamação de cliente, marcar mesa em restaurante, enviar uma alteração de código, gerar um relatório. Tudo tem começo, meio e fim. E tem um resultado que alguém consegue conferir.
Agora imagina o contrário. Você pergunta o horário do restaurante, a IA responde, acabou. Isso não é agente. É uma resposta.
A separação é simples: a tarefa acabou quando o resultado ficou pronto, ou acabou quando você leu a resposta? Primeiro caso pode ser agente. Segundo caso é chat.
O guia também tira do pacote o chatbot simples, o modelo de uma resposta só e o programa que só diz se o texto é positivo ou negativo. Usa IA, mas não comanda a execução da tarefa. Não é agente.
Quando vale construir um, e quando não vale
Agente não é a resposta para tudo, e o guia corta isso logo no começo: antes de construir, confira se o seu caso cumpre esses critérios direito. Se não cumpre, solução simples resolve. São três situações em que a automação de sempre costuma travar:
Os três casos em que agente faz sentido
Decisão com julgamento
Tem exceção e contexto. Exemplo deles: aprovar ou não um reembolso.
Regra que ninguém aguenta mais manter
A lista de "se acontecer isso, faz aquilo" virou um bolo caro e cheio de furo.
Texto que regra não lê
E-mail, documento, conversa. Dado sem formato.
O exemplo deles é o de fraude em pagamento. A regra é uma lista de checagem: marcou um item, bandeira. O agente investiga. Olha o contexto, compara padrão e sente que tem coisa estranha mesmo sem nenhum item da lista estourar.
Aí vem a parte que eu usaria para decidir: quando a regra é limpa e curta, regra ganha. É barato, previsível e não te surpreende. Agente entra quando a regra já virou um mapa impossível de manter. Se o seu caso dá para resolver com meia dúzia de se e senão, não monta agente. Monta a regra.
As três partes de todo agente
Todo agente, por dentro, são três coisas:
Cérebro, ferramenta e manual
Cérebro (modelo)
A parte que pensa e escolhe o próximo passo. Nem sempre precisa ser o mais caro.
Ferramenta
O que ele pode usar: ler dado, mexer em sistema, chamar outro agente.
Instrução (manual)
As regras do trabalho: o que fazer, o que não pode e quando parar.
O cérebro
O guia fala uma coisa simples aqui: primeiro faça com o melhor modelo que você tem. Pega o resultado como referência. Depois vai trocando por um modelo menor e mais barato para ver se ainda passa. Antes de trocar, monta um conjunto de perguntas de teste: o que passava com o modelo grande tem que continuar passando com o menor.
Se trocar logo de cara, você perde o ponto de comparação. Aí não sabe onde o menor falha. Só sabe que ficou barato.
A ferramenta
São três tipos:
- ler: consultar banco de dados, abrir PDF, buscar na web, olhar o CRM (a ficha de cliente da empresa);
- agir: mandar e-mail, atualizar cadastro, passar um chamado para uma pessoa;
- repassar: o próprio agente vira ferramenta de outro agente.
Detalhe que vale guardar: sistema antigo sem API (o caminho oficial de um programa falar com outro), o agente pode usar a tela do jeito que uma pessoa usaria. Clicar, digitar, preencher. Parece mágica, mas pra mim é o caminho mais caro de manter.
O manual
Aqui mora o erro de quem está começando: escrever um texto de instrução gigante (prompt) e rezar.
A proposta é outra. Usa o documento que já existe: procedimento da empresa, roteiro de atendimento, política. Depois quebra em passo curto, onde cada linha vira uma ação concreta. "Peça o número do pedido." "Chame a API que busca a conta." E escreve o que fazer quando faltar informação ou a pessoa pular de assunto.
Ninguém lê instrução bonita. O que vale é a que o agente consegue seguir sem adivinhar.
Um agente só, e depois, se precisar
O conselho que eu manteria: estica o agente único o máximo que der antes de virar equipe.
Um agente é um cérebro com suas ferramentas e seu manual, rodando até a tarefa terminar. Ele para quando entrega o resultado, quando erra, quando bate no limite de tentativas. Reconhece quando acabou, se corrige no meio do caminho e, quando trava de vez, devolve o controle pra você. Enquanto isso funciona, não existe motivo para dividir.

Divide quando aparecer um de dois sintomas: o manual virou um monte de se isso senão aquilo, ou as ferramentas começaram a se confundir entre si.
Sobre ferramenta, o guia diz que o problema não é só a quantidade. O que derruba é ferramenta parecida demais com a outra. Tem time que lida bem com 15 certinhas. Tem time que se perde com 10 quase iguais. Antes desses sintomas, dividir só troca um problema por dois.
Antes de dividir, o guia manda tentar o óbvio: nome claro na ferramenta, parâmetro certinho, descrição do que ela faz. Se isso não conserta, aí sim divide.
O guia ainda poupa manutenção com um truque: em vez de uma instrução diferente pra cada caso, escreve uma base só com lacunas — o nome do cliente, há quanto tempo ele é cliente, o tipo de reclamação — e troca só o que entra na lacuna. Regra mudou, muda a lacuna, não o texto inteiro.
Quando precisa virar time, o guia mostra dois desenhos:


Gerente no centro
- Um agente manda e os outros executam
- Ele conhece o trabalho de cada um e escolhe quem faz a parte certa
- Ele delega a tarefa, junta o resultado e continua falando com você
- Útil quando você quer uma pessoa só do outro lado
Passa a bola
- Recepção entende o pedido e passa para o time certo
- O agente que assume continua a conversa com você
- Útil quando o pedido pode cair em assuntos de times diferentes
- Cada um pode assumir e devolver o controle para o anterior
Guardrails: o adulto na sala
"Guardrail" é grade de proteção. Em português: o adulto olhando antes de atravessar a rua.
Não é porque a criança é burra. É porque a consequência de errar é grande. O guia é direto aqui: uma proteção sozinha não protege. Vão camadas em cima de camadas.
O ponto de partida que eles sugerem é o básico: dado pessoal e conteúdo perigoso. Depois vai acrescentando proteção conforme o erro aparecer na vida real.

As proteções que ele lista
Fora do assunto
Um pedaço do sistema corta pergunta que não tem nada a ver com a tarefa.
Tentativa de sequestrar
Outro pedaço percebe quando alguém tenta extrair o manual ou trocar as regras.
Dado pessoal
Filtro para dado de pessoa não vazar na resposta.
Conteúdo impróprio
Filtro que marca ódio, assédio ou violência logo na entrada.
Ferramenta com risco
Cada ferramenta ganha uma nota. A nota sobe conforme o que ela faz: só ler costuma ficar baixa; escrever, mexer em dinheiro ou apagar de vez sobem a nota. Nota alta pede pessoa antes.
Por baixo disso tem regra simples mesmo: lista bloqueada, limite de tamanho, busca de texto proibido. E na saída, uma conferência para o que a IA respondeu não sair fora do que a sua marca pode falar.
Dois gatilhos chamam uma pessoa: estourou o limite de tentativas, ou a ação é de alto risco. Cancelar pedido, aprovar reembolso grande, mandar dinheiro. Esses ficam com gente até você ter confiança de sobra no agente.
O que eu copiaria e o que eu não copiaria
Eu copiaria
- Começar por uma tarefa que já acontece toda semana
- Manual escrito, quebrado em passo curto
- Leitura roda, ação aprova
- Tempo total contando a revisão
Eu não copiaria
- Montar time de agente antes de um só funcionar
- Modelo caro para tudo
- Ficar refazendo instrução em vez de medir
- Dinheiro, exclusão e envio sem pessoa olhando
O ponto do guia que eu mais levaria para a vida: não é tudo ou nada. Começa pequeno, valida com gente de verdade, cresce depois.
Um teste para fazer amanhã
- Escolha uma tarefa que você fez pelo menos duas vezes nas últimas semanas. Relatório, triagem de e-mail, pesquisa ou primeira versão de conteúdo servem.
- Escreva em três linhas: o que tem que ficar pronto, o que ele pode usar e o que não pode acontecer.
- Rode uma vez, com o melhor modelo que você tem.
- Conte o tempo inteiro: montar, conferir e corrigir. E anote quantas coisas você precisou corrigir.
- Se ficou mais rápido do que fazer na mão, contando o tempo de conferir, e as correções couberem no que você aceita no dia a dia, roda de novo. Se não, você aprendeu qual parte do seu processo está mal definida. E isso já valeu.
Minha leitura
A parte difícil nunca foi montar o agente.
É ter processo escrito, resultado conferível e alguém que confere. Sem essas três, você não tem agente. Tem automação com cara de agente esperando dar problema.
Eu começaria pela tarefa chata que repete toda semana, daria a ela o manual mais curto possível e deixaria a leitura rodar enquanto a ação espera aprovação. Mediria o tempo inteiro, incluindo a revisão. Só daria mais liberdade depois de ver o erro diminuir.
Fontes
- A practical guide to building agents — OpenAI
- Chat, assistente, automação e agente
- O que os agentes de IA já conseguem fazer no trabalho
- Como agentes de IA estão sendo usados em produtos reais
Os conceitos, exemplos e critérios técnicos deste texto vêm do guia da OpenAI. A leitura, os limites e o veredito são meus.
