Agente de IA

Habilitar análise de imagens com modelos multimodais e configurar o que o agente pode ver.

Como usar visão (imagens) no agente

Com modelos compatíveis, o agente consegue ver e entender imagens enviadas pelo cliente no WhatsApp.

O que o agente pode fazer

  • Ler texto em fotos (cardápios, etiquetas, documentos)
  • Identificar produtos em imagens
  • Analisar comprovantes ou notas fiscais
  • Descrever o conteúdo de uma foto enviada pelo cliente

Como habilitar

  1. Acesse Agentes e abra o agente desejado
  2. Em Configurações, escolha um modelo com suporte a visão:
    • GPT-4o
    • Gemini 2.5 Flash
    • Claude 3.5 Sonnet
  3. No prompt, explique como tratar imagens recebidas
  4. Salve e teste enviando uma foto no chat de teste

/agents/{id} (Modelo com visão) Figura 1: Seleção de modelo compatível com análise de imagens

Exemplo de instrução

Quando o cliente enviar uma imagem:

  • Descreva o que vê de forma objetiva
  • Se for um produto, identifique e sugira opções similares
  • Se não conseguir identificar, peça mais detalhes

Dicas

  • Nem todo modelo suporta imagens — verifique antes de ativar
  • Análise de imagens consome mais tokens (custo maior)
  • Teste com fotos reais que seus clientes costumam enviar
  • Defina limites: o agente não deve diagnosticar problemas médicos em fotos, por exemplo

Este artigo foi útil?

Precisa de mais ajuda? Falar com suporte

Central de Ajuda