Agente de IA

Como o consumo de tokens é calculado, como monitorar e como reduzir custos de IA.

Tokens e custo por conversa

Tokens são a "unidade de consumo" da IA. Cada mensagem enviada e recebida pelo agente usa tokens — e isso impacta seu plano.

O que são tokens

Pense em tokens como "pedaços de texto". Quanto maior a conversa, mais tokens são usados.

Fatores que aumentam o consumo:

  • Conversas longas (muitas mensagens)
  • Prompt e memórias extensos
  • Modelos mais avançados (GPT-4o, Claude)
  • Análise de imagens

Onde monitorar

  1. Dashboard — visão geral do consumo da conta
  2. Página do agente — tokens usados por aquele agente
  3. Sessões — detalhe de cada atendimento automático do agente

Na página do agente, Sessões e o gráfico Sessões por Período referem-se às sessões de IA (memória curta do agente), não às conversas abertas da Central. Veja Sessão do agente vs conversa.

/agents/{id} (Tokens) Figura 1: Indicador de consumo de tokens na página do agente

Como reduzir custos

  1. Use Gemini 2.5 Flash para atendimentos simples
  2. Mantenha o prompt enxuto — só o essencial
  3. Organize memórias por tema e evite textos gigantes
  4. Reduza o histórico de mensagens nas configurações
  5. Transfira para humano em conversas que se prolongam sem necessidade

Tokens extras

Se o consumo do plano acabar:

  1. Acesse ConfiguraçõesPlano e cobrança
  2. Compre um pacote adicional de tokens
  3. O agente volta a funcionar automaticamente

→ Veja também Como funcionam os tokens de IA na seção Planos e Cobrança.

Este artigo foi útil?

Precisa de mais ajuda? Falar com suporte

Central de Ajuda