Automações

Modelos hospedados na Groq com chat completions de baixa latência.

Nó Groq

O nó Groq (groq_chat) executa modelos GPT OSS e Llama na API de inferência rápida da Groq pelo proxy de IA de workflows da WhatsWave. Use quando a latência importa — classificação em tempo real, respostas rápidas ou processamento de webhooks em alto throughput nas Automações.

Workflows > editor > Groq node configuration Figura 1: Nó Groq — API key, model, prompt e temperature

O que faz

A cada execução, o engine do workflow:

  1. Resolve variáveis em Messages (JSON)
  2. Envia POST {{API_URL}}/workflows/ai/chat com provider groq
  3. Autentica com o integration token da empresa
  4. Usa a Groq API key selecionada
  5. Retorna data.choices[0].message.content mais usage; strings JSON em content podem ser auto-parseadas
PropriedadeValor
Node type IDgroq_chat
Palette labelGroq
Executorhttp_request (proxied)
API endpointPOST /workflows/ai/chat
Provider enviado no bodygroq
Request timeout30 segundos

Pré-requisitos

  1. Integration tokenSettings → API Keys
  2. Groq API key — adicione em AI / LLM keys e selecione no nó
  3. Cota de tokens ou chave própria

Guia de configuração

Passo 1 — Adicionar o nó

  1. Abra Automações
  2. Paleta → AIGroq
  3. Posicione cedo no fluxo quando precisar de decisões rápidas antes de integrações mais lentas

Passo 2 — Selecionar API key e model

ControleDescrição
API keyChave Groq das configurações da empresa
ModelModelo na Groq

Modelos disponíveis (template do nó):

ValueLabelDefault
openai/gpt-oss-120bGPT OSS 120BSim
openai/gpt-oss-20bGPT OSS 20B
llama-3.3-70b-versatileLlama 3.3 70B
llama-3.1-8b-instantLlama 3.1 8B Instant

Guia de seleção:

  • GPT OSS 20B / 8B Instant — menor latência; sim/não simples, intenção por palavra-chave, respostas curtas
  • GPT OSS 120B / 3.3 70B — melhor qualidade ainda mais rápida que muitos LLMs em nuvem; padrão para fluxos equilibrados

Passo 3 — Escrever o prompt

Messages (JSON) padrão:

[{ "role": "user", "content": "" }]

Exemplo — filtro rápido de spam:

Is this message spam? Reply only "yes" or "no".
Message: {{trigger.body.message}}

Exemplo — saída estruturada:

[
  {
    "role": "system",
    "content": "Reply JSON: {\"urgent\":boolean,\"topic\":string}"
  },
  {
    "role": "user",
    "content": "{{trigger.body.text}}"
  }
]

Passo 4 — Temperature

CampoDefaultRange
Temperature0.70–2

Use 0–0.2 para rótulos de roteamento determinísticos no caminho rápido da Groq.

Passo 5 — Testar

Execuções Groq costumam ser sub-segundo. Use Play no nó e confirme data.choices[0].message.content na saída.

Campos de saída

CaminhoDescrição
statusStatus HTTP
data.choices[0].message.contentTexto do modelo (JSON pode ser parseado em objeto)
data.usage.prompt_tokensTokens de entrada
data.usage.completion_tokensTokens de saída
data.usage.total_tokensTotal
data.is_own_keyFlag de chave Groq própria

Exemplos (node ID groq_1):

{{groq_1.data.choices[0].message.content}}
{{input.data.choices[0].message.content}}

O proxy WhatsWave tenta parsear JSON no conteúdo do assistente para Groq (e OpenAI), então content pode ser um objeto quando o modelo retorna JSON válido.

Dicas e boas práticas

  • Primeiro nó após webhook — Groq minimiza time-to-first-decision antes de etapas CRM/WhatsApp
  • 8B para portões — checagem de spam, detecção de idioma, roteamento binário
  • 70B para geração leve — respostas curtas ao cliente quando qualidade ainda importa
  • Mantenha prompts curtos — inferência mais rápida e menor custo de tokens
  • Chave Groq própria para picos de tráfego — evita limites de cota do plano
  • Combine com Delay apenas ao limitar taxa de APIs externas, não da Groq em si

FAQ

Qual a diferença entre Groq e OpenAI na WhatsWave?

Mesmo endpoint proxy (/workflows/ai/chat), mas provider groq e modelos Llama hospedados na Groq. Tipicamente menor latência, lineup de modelos diferente.

Por que o parse de JSON falhou?

O modelo retornou prosa ou markdown fences. Aperte o system prompt: "Valid JSON only, no explanation."

Posso rodar Groq sem o proxy?

Use o nó HTTP contra https://api.groq.com/openai/v1/chat/completions com integration key groq_api_key se precisar de acesso bruto à API.

Os tokens são cobrados no meu plano?

Sim, a menos que is_own_key seja true. Confira data.usage após cada execução.

Exemplos de uso

Exemplo 1 — Roteamento de intenção em sub-segundo

Groq (8B Instant, temp 0):

Intent: sales|support|other. One word only.
{{trigger.body.message}}

Condition na string de intenção em minúsculas

Exemplo 2 — Sim/Não antes de API cara

Groq:

Does this message mention a tracking number? yes/no
{{trigger.body.message}}

Condition → só chama nó HTTP da transportadora quando "yes"

Exemplo 3 — Rascunho rápido, polimento com OpenAI

  1. Groq — rascunha resposta a partir do contexto FAQ
  2. OpenAI (opcional) — refina o tom
  3. Send message

Referências de API

RecursoLink
WhatsWave workflow AI chatPOST https://api.whatswave.com.br/workflows/ai/chat
Groq APIconsole.groq.com/docs
Groq OpenAI compatibilityconsole.groq.com/docs/openai
Visão geral do grupo IA/ajuda/nos-workflow-ai
Nó Delay/ajuda/nos-workflow-logica-delay

Este artigo foi útil?

Precisa de mais ajuda? Falar com suporte

Central de Ajuda