Modelos hospedados na Groq com chat completions de baixa latência.
Nó Groq
O nó Groq (groq_chat) executa modelos GPT OSS e Llama na API de inferência rápida da Groq pelo proxy de IA de workflows da WhatsWave. Use quando a latência importa — classificação em tempo real, respostas rápidas ou processamento de webhooks em alto throughput nas Automações.
Figura 1: Nó Groq — API key, model, prompt e temperature
O que faz
A cada execução, o engine do workflow:
- Resolve variáveis em Messages (JSON)
- Envia
POST {{API_URL}}/workflows/ai/chatcom providergroq - Autentica com o integration token da empresa
- Usa a Groq API key selecionada
- Retorna
data.choices[0].message.contentmais usage; strings JSON em content podem ser auto-parseadas
| Propriedade | Valor |
|---|---|
| Node type ID | groq_chat |
| Palette label | Groq |
| Executor | http_request (proxied) |
| API endpoint | POST /workflows/ai/chat |
| Provider enviado no body | groq |
| Request timeout | 30 segundos |
Pré-requisitos
- Integration token — Settings → API Keys
- Groq API key — adicione em AI / LLM keys e selecione no nó
- Cota de tokens ou chave própria
Guia de configuração
Passo 1 — Adicionar o nó
- Abra Automações
- Paleta → AI → Groq
- Posicione cedo no fluxo quando precisar de decisões rápidas antes de integrações mais lentas
Passo 2 — Selecionar API key e model
| Controle | Descrição |
|---|---|
| API key | Chave Groq das configurações da empresa |
| Model | Modelo na Groq |
Modelos disponíveis (template do nó):
| Value | Label | Default |
|---|---|---|
openai/gpt-oss-120b | GPT OSS 120B | Sim |
openai/gpt-oss-20b | GPT OSS 20B | |
llama-3.3-70b-versatile | Llama 3.3 70B | |
llama-3.1-8b-instant | Llama 3.1 8B Instant |
Guia de seleção:
- GPT OSS 20B / 8B Instant — menor latência; sim/não simples, intenção por palavra-chave, respostas curtas
- GPT OSS 120B / 3.3 70B — melhor qualidade ainda mais rápida que muitos LLMs em nuvem; padrão para fluxos equilibrados
Passo 3 — Escrever o prompt
Messages (JSON) padrão:
[{ "role": "user", "content": "" }]
Exemplo — filtro rápido de spam:
Is this message spam? Reply only "yes" or "no".
Message: {{trigger.body.message}}
Exemplo — saída estruturada:
[
{
"role": "system",
"content": "Reply JSON: {\"urgent\":boolean,\"topic\":string}"
},
{
"role": "user",
"content": "{{trigger.body.text}}"
}
]
Passo 4 — Temperature
| Campo | Default | Range |
|---|---|---|
| Temperature | 0.7 | 0–2 |
Use 0–0.2 para rótulos de roteamento determinísticos no caminho rápido da Groq.
Passo 5 — Testar
Execuções Groq costumam ser sub-segundo. Use Play no nó e confirme data.choices[0].message.content na saída.
Campos de saída
| Caminho | Descrição |
|---|---|
status | Status HTTP |
data.choices[0].message.content | Texto do modelo (JSON pode ser parseado em objeto) |
data.usage.prompt_tokens | Tokens de entrada |
data.usage.completion_tokens | Tokens de saída |
data.usage.total_tokens | Total |
data.is_own_key | Flag de chave Groq própria |
Exemplos (node ID groq_1):
{{groq_1.data.choices[0].message.content}}
{{input.data.choices[0].message.content}}
O proxy WhatsWave tenta parsear JSON no conteúdo do assistente para Groq (e OpenAI), então content pode ser um objeto quando o modelo retorna JSON válido.
Dicas e boas práticas
- Primeiro nó após webhook — Groq minimiza time-to-first-decision antes de etapas CRM/WhatsApp
- 8B para portões — checagem de spam, detecção de idioma, roteamento binário
- 70B para geração leve — respostas curtas ao cliente quando qualidade ainda importa
- Mantenha prompts curtos — inferência mais rápida e menor custo de tokens
- Chave Groq própria para picos de tráfego — evita limites de cota do plano
- Combine com Delay apenas ao limitar taxa de APIs externas, não da Groq em si
FAQ
Qual a diferença entre Groq e OpenAI na WhatsWave?
Mesmo endpoint proxy (/workflows/ai/chat), mas provider groq e modelos Llama hospedados na Groq. Tipicamente menor latência, lineup de modelos diferente.
Por que o parse de JSON falhou?
O modelo retornou prosa ou markdown fences. Aperte o system prompt: "Valid JSON only, no explanation."
Posso rodar Groq sem o proxy?
Use o nó HTTP contra https://api.groq.com/openai/v1/chat/completions com integration key groq_api_key se precisar de acesso bruto à API.
Os tokens são cobrados no meu plano?
Sim, a menos que is_own_key seja true. Confira data.usage após cada execução.
Exemplos de uso
Exemplo 1 — Roteamento de intenção em sub-segundo
Groq (8B Instant, temp 0):
Intent: sales|support|other. One word only.
{{trigger.body.message}}
Condition na string de intenção em minúsculas
Exemplo 2 — Sim/Não antes de API cara
Groq:
Does this message mention a tracking number? yes/no
{{trigger.body.message}}
Condition → só chama nó HTTP da transportadora quando "yes"
Exemplo 3 — Rascunho rápido, polimento com OpenAI
- Groq — rascunha resposta a partir do contexto FAQ
- OpenAI (opcional) — refina o tom
- Send message
Referências de API
| Recurso | Link |
|---|---|
| WhatsWave workflow AI chat | POST https://api.whatswave.com.br/workflows/ai/chat |
| Groq API | console.groq.com/docs |
| Groq OpenAI compatibility | console.groq.com/docs/openai |
| Visão geral do grupo IA | /ajuda/nos-workflow-ai |
| Nó Delay | /ajuda/nos-workflow-logica-delay |
Este artigo foi útil?
Precisa de mais ajuda? Falar com suporte