Agente de IA
Como o consumo de tokens é calculado, como monitorar e como reduzir custos de IA.
Tokens e custo por conversa
Tokens são a "unidade de consumo" da IA. Cada mensagem enviada e recebida pelo agente usa tokens — e isso impacta seu plano.
O que são tokens
Pense em tokens como "pedaços de texto". Quanto maior a conversa, mais tokens são usados.
Fatores que aumentam o consumo:
- Conversas longas (muitas mensagens)
- Prompt e memórias extensos
- Modelos mais avançados (GPT-4o, Claude)
- Análise de imagens
Onde monitorar
- Dashboard — visão geral do consumo da conta
- Página do agente — tokens usados por aquele agente
- Sessões — detalhe de cada atendimento automático do agente
Na página do agente, Sessões e o gráfico Sessões por Período referem-se às sessões de IA (memória curta do agente), não às conversas abertas da Central. Veja Sessão do agente vs conversa.
Figura 1: Indicador de consumo de tokens na página do agente
Como reduzir custos
- Use Gemini 2.5 Flash para atendimentos simples
- Mantenha o prompt enxuto — só o essencial
- Organize memórias por tema e evite textos gigantes
- Reduza o histórico de mensagens nas configurações
- Transfira para humano em conversas que se prolongam sem necessidade
Tokens extras
Se o consumo do plano acabar:
- Acesse Configurações → Plano e cobrança
- Compre um pacote adicional de tokens
- O agente volta a funcionar automaticamente
→ Veja também Como funcionam os tokens de IA na seção Planos e Cobrança.
Este artigo foi útil?
Precisa de mais ajuda? Falar com suporte