O que são tokens, como são cobrados por modelo e como acompanhar o consumo.
Como funcionam os tokens de IA
Tokens são a "unidade de consumo" da inteligência artificial na WhatsWave. Cada vez que o agente lê uma mensagem e gera uma resposta, ele usa tokens do seu plano.
O que são tokens, na prática
Pense nos tokens como créditos de IA:
- Quanto maior a conversa, mais tokens são usados
- Modelos mais avançados (como GPT-4o) consomem mais tokens que modelos mais rápidos
- Análise de imagens também consome tokens extras
Você não precisa contar manualmente — a plataforma faz isso por você.
Quota mensal do plano
Todo plano pago inclui uma quota mensal de tokens. Ela é renovada a cada ciclo de cobrança (geralmente a cada 30 dias).
Para acompanhar o uso:
- Acesse Configurações → Cobrança
- Na seção Consumo de tokens, veja a barra de progresso
- Confira quanto já foi usado e quanto ainda resta no ciclo

Consumo flexível (excedente)
Se você ativar o Consumo flexível, o agente não para quando a quota acabar. O uso extra é cobrado na próxima fatura, com tarifa por milhão de tokens excedentes.
Para ativar ou desativar:
- Em Configurações → Cobrança, localize Consumo de tokens
- Use o interruptor Consumo flexível no canto superior direito do card
- Com flexível desativado, a IA é bloqueada ao atingir a quota
Atenção: Com consumo flexível desligado, o agente deixa de responder quando os tokens acabam. Ative se não quiser interrupção no atendimento.
Onde ver o custo por conversa
No painel do Agente, a seção de métricas mostra o consumo de tokens por período. Use isso para entender quais conversas ou fluxos gastam mais.
Próximos passos
Este artigo foi útil?
Precisa de mais ajuda? Falar com suporte