Tema
Memória do Agent
Pensa num atendente que, toda vez que um cliente liga, começa do zero — sem lembrar que aquela pessoa já ligou ontem com o mesmo problema. Frustrante, né? A memória do Agent resolve exatamente isso.
Com a memória habilitada, o Agent extrai e armazena fatos importantes das conversas (nome do cliente, preferências, problemas recorrentes) e os recupera automaticamente nas próximas interações. O resultado é uma conversa muito mais natural e personalizada.
Como funciona
- Durante a conversa: o Agent identifica fatos relevantes que o cliente mencionou.
- Ao final: um modelo de IA de extração (por padrão,
gpt-4o-mini) lê a conversa e salva os fatos mais importantes numa base de memória vinculada ao contato. - Na próxima conversa: antes de responder, o Agent busca automaticamente os fatos salvos daquele contato e os inclui no contexto — como se o atendente tivesse relido as anotações antes de atender.
- Durante a conversa, sob demanda: além da busca automática no início, o Agent também pode buscar um fato específico que não veio nessa busca inicial — útil em conversas longas. Disponível automaticamente quando a memória está ligada no nó Agente de IA; veja os detalhes em Agente de IA → Busca de memória sob demanda.
Habilitando a memória
Para ativar, acesse a aba Memória nas configurações do Agent e ligue o toggle Habilitar memória.
Acesse as configurações do Agent e clique na aba Memória.
Ligue o toggle Habilitar memória.
Ajuste os parâmetros conforme a necessidade do seu Agent (detalhes abaixo).
Salve as configurações e teste enviando algumas mensagens no painel de teste. Na segunda conversa, verifique se o Agent lembra dos fatos da primeira.
Parâmetros de memória
| Parâmetro | Padrão | O que controla |
|---|---|---|
| Habilitar memória | Desligado | Liga ou desliga a memória |
| Quantidade de fatos recuperados (Top K) | 5 | Quantos fatos são recuperados por conversa. Mais fatos = mais contexto, mas também mais tokens (custo). |
| Similaridade mínima | 0.75 | Nota mínima de parecença (de 0 a 1) para um fato ser considerado relevante para a conversa atual. Valores mais altos = mais precisão, mas menos fatos retornados. |
| Máximo de fatos armazenados | 200 | Máximo de fatos guardados por contato. Quando atinge o limite, os mais antigos são descartados. |
| Modelo de extração | gpt-4o-mini | Modelo usado para extrair fatos da conversa. O gpt-4o-mini já equilibra bem custo e qualidade. |
| Dias de retenção | 365 | Por quantos dias os fatos ficam armazenados antes de expirar. |
Atenção
O toggle "Habilitar memória" aqui no Agent controla só a extração (salvar fatos ao final da conversa). Para o Agent efetivamente ler esses fatos numa conversa, o nó Agente de IA que o executa no Flow Builder também precisa ter a opção Memória ligada (desligada por padrão). São dois interruptores independentes — os dois precisam estar ligados. Veja o detalhe em Agente de IA → Memória do Agent no nó.
Boas práticas
Dica
Comece com os valores padrão. Eles já funcionam bem para a maioria dos casos. Ajuste a quantidade de fatos recuperados (para mais contexto) ou a similaridade mínima (para mais precisão) só se perceber problemas de comportamento.
Atenção
Fatos armazenados na memória contêm dados dos clientes — nome, preferências, histórico de problemas. Isso é dado pessoal. Siga as políticas de privacidade da sua empresa e as regras da LGPD ao habilitar essa funcionalidade. Use o campo de dias de retenção para garantir que dados não sejam guardados indefinidamente além do necessário.
Quando usar uma quantidade maior de fatos recuperados (ex.: 10):
- Conversas longas com muito contexto acumulado
- Agents de suporte com histórico rico de problemas
Quando usar uma similaridade mínima mais alta (ex.: 0.85):
- Quando o Agent está recuperando fatos irrelevantes e "confundindo" as conversas de clientes diferentes
Saiba mais
- Conhecimento (Base de Conhecimento) — outra forma de dar contexto ao Agent, a partir de documentos
- Ferramentas do Agent — conectar sistemas externos, skills e sub-agents
