Agente de IA
Habilitar análise de imagens com modelos multimodais e configurar o que o agente pode ver.
Como usar visão (imagens) no agente
Com modelos compatíveis, o agente consegue ver e entender imagens enviadas pelo cliente no WhatsApp.
O que o agente pode fazer
- Ler texto em fotos (cardápios, etiquetas, documentos)
- Identificar produtos em imagens
- Analisar comprovantes ou notas fiscais
- Descrever o conteúdo de uma foto enviada pelo cliente
Como habilitar
- Acesse Agentes e abra o agente desejado
- Em Configurações, escolha um modelo com suporte a visão:
- GPT-4o
- Gemini 2.5 Flash
- Claude 3.5 Sonnet
- No prompt, explique como tratar imagens recebidas
- Salve e teste enviando uma foto no chat de teste
Figura 1: Seleção de modelo compatível com análise de imagens
Exemplo de instrução
Quando o cliente enviar uma imagem:
- Descreva o que vê de forma objetiva
- Se for um produto, identifique e sugira opções similares
- Se não conseguir identificar, peça mais detalhes
Dicas
- Nem todo modelo suporta imagens — verifique antes de ativar
- Análise de imagens consome mais tokens (custo maior)
- Teste com fotos reais que seus clientes costumam enviar
- Defina limites: o agente não deve diagnosticar problemas médicos em fotos, por exemplo
Este artigo foi útil?
Precisa de mais ajuda? Falar com suporte