Agentes: prompt, ferramentas e departamento#
O agente é a identidade da IA num setor: como ela fala, o que ela resolve, o que ela recusa e para quem ela transfere. É aqui que a maior parte dos erros de configuração acontece — quase sempre por escrever conteúdo no lugar do comportamento.
As partes de um agente#
| Parte | O que é | Custa token por mensagem? |
|---|---|---|
| Cérebro (persona) | Tom, estilo, como se comportar | Sim, inteira |
| Limites de atuação | O que resolve e o que não faz | Sim, inteiros |
| Base de conhecimento | Os fatos que ele consulta | Só os trechos que casaram |
| Ferramentas | O que ele pode executar (consultas, fluxos) | Só nome e descrição |
| Departamento | Para onde o atendimento vai quando ele transfere | Pequeno |
As duas primeiras linhas explicam a regra mais importante desta página.
A persona é cara: escreva-a curta#
Cada caractere do cérebro é enviado ao modelo em toda mensagem de toda conversa. Um cérebro de 17 mil caracteres — que é o tamanho que fica quando alguém escreve ali os oito assuntos do suporte — custa isso todo dia, para sempre.
O mesmo conteúdo, na base, custa uma fração: a base manda no máximo 6 trechos por mensagem, independentemente do tamanho dela.
Uma persona boa é curta e fala só de comportamento:
Você atende clientes de um provedor de internet.
Fale de forma cordial e direta, use o primeiro nome do cliente,
não use gírias e não prometa prazo que você não pode confirmar.
Responda em até três frases sempre que possível.
Tudo que for fato — preço, procedimento, prazo, política — vai na base de conhecimento.
Limites: escreva no campo próprio#
Existe um campo separado para "o que este agente não faz". Use-o em vez de escrever a mesma regra dentro do texto da persona.
O motivo é prático: no meio de um texto grande, a regra se perde — para o modelo e para a próxima pessoa que for editar. Em campo próprio, ela é visível e não some.
Exemplos de limite que todo provedor precisa:
- Não negociar desconto nem prazo de pagamento.
- Não prometer data de visita técnica.
- Não confirmar cancelamento; transferir.
- Não pedir senha, dado bancário nem código de verificação.
Um agente ou vários#
A tentação é criar um agente por assunto. O ganho de custo disso é pequeno: a base já tem teto fixo de 6 trechos por mensagem, então dividir não encolhe esse bloco — a economia medida entre "persona enxuta com um agente" e "um agente por área" fica em torno de 3%.
O que justifica agentes separados não é o custo, e sim a separação de responsabilidade: um agente de suporte que não fala de fatura, um de financeiro que não dá procedimento técnico. Isso melhora a resposta e deixa os limites mais simples de escrever.
Como fazer#
- Vá em Agentes e crie o agente.
- Escreva o cérebro curto, só sobre comportamento.
- Preencha os limites de atuação, um por linha.
- Ligue as ferramentas que ele pode usar — consultas ao ERP, fluxos disponíveis.
- Defina o departamento para o qual ele transfere quando passa para humano.
- Aponte a base de conhecimento dele.
- Teste no chat de teste antes de ligar em produção.
Antes de ligar em produção#
Um agente novo fala com clientes reais desde a primeira mensagem. Teste, no mínimo:
- Uma pergunta que a base responde.
- Uma pergunta que a base não responde — para ver se ele desiste em vez de inventar.
- Uma pergunta que cai num limite — para ver se ele recusa e transfere.
- Um pedido de atendente humano.
O último é o mais importante. Um agente que não deixa o cliente falar com gente é a reclamação mais cara que um provedor pode gerar.
Se algo der errado#
A IA inventa informação. O fato não está na base, ou a persona autoriza improviso. Tire do cérebro qualquer frase que peça para ele "ajudar como puder".
A IA responde o que não deveria. Falta limite, ou o limite está escrito no meio da persona. Mova-o para o campo próprio.
A IA não transfere. Confira o departamento configurado e se ele tem atendente disponível — veja A fila de atendimento.
O custo por mensagem está alto. Meça o tamanho do cérebro. É a causa mais comum, e a única que cresce sozinha conforme as pessoas vão "melhorando o prompt".
Duas respostas diferentes para a mesma pergunta. Dois agentes com bases diferentes atendendo o mesmo canal, ou duas entradas competindo na mesma base.