Skip to content

Memória do Agent

Pensa num atendente que, toda vez que um cliente liga, começa do zero — sem lembrar que aquela pessoa já ligou ontem com o mesmo problema. Frustrante, né? A memória do Agent resolve exatamente isso.

Com a memória habilitada, o Agent extrai e armazena fatos importantes das conversas (nome do cliente, preferências, problemas recorrentes) e os recupera automaticamente nas próximas interações. O resultado é uma conversa muito mais natural e personalizada.

Como funciona

  1. Durante a conversa: o Agent identifica fatos relevantes que o cliente mencionou.
  2. Ao final: um modelo de IA de extração (por padrão, gpt-4o-mini) lê a conversa e salva os fatos mais importantes numa base de memória vinculada ao contato.
  3. Na próxima conversa: antes de responder, o Agent busca automaticamente os fatos salvos daquele contato e os inclui no contexto — como se o atendente tivesse relido as anotações antes de atender.
  4. Durante a conversa, sob demanda: além da busca automática no início, o Agent também pode buscar um fato específico que não veio nessa busca inicial — útil em conversas longas. Disponível automaticamente quando a memória está ligada no nó Agente de IA; veja os detalhes em Agente de IA → Busca de memória sob demanda.

Habilitando a memória

Para ativar, acesse a aba Memória nas configurações do Agent e ligue o toggle Habilitar memória.

  1. Acesse as configurações do Agent e clique na aba Memória.

  2. Ligue o toggle Habilitar memória.

  3. Ajuste os parâmetros conforme a necessidade do seu Agent (detalhes abaixo).

  4. Salve as configurações e teste enviando algumas mensagens no painel de teste. Na segunda conversa, verifique se o Agent lembra dos fatos da primeira.

Parâmetros de memória

ParâmetroPadrãoO que controla
Habilitar memóriaDesligadoLiga ou desliga a memória
Quantidade de fatos recuperados (Top K)5Quantos fatos são recuperados por conversa. Mais fatos = mais contexto, mas também mais tokens (custo).
Similaridade mínima0.75Nota mínima de parecença (de 0 a 1) para um fato ser considerado relevante para a conversa atual. Valores mais altos = mais precisão, mas menos fatos retornados.
Máximo de fatos armazenados200Máximo de fatos guardados por contato. Quando atinge o limite, os mais antigos são descartados.
Modelo de extraçãogpt-4o-miniModelo usado para extrair fatos da conversa. O gpt-4o-mini já equilibra bem custo e qualidade.
Dias de retenção365Por quantos dias os fatos ficam armazenados antes de expirar.

Boas práticas

Dica

Comece com os valores padrão. Eles já funcionam bem para a maioria dos casos. Ajuste a quantidade de fatos recuperados (para mais contexto) ou a similaridade mínima (para mais precisão) só se perceber problemas de comportamento.

Quando usar uma quantidade maior de fatos recuperados (ex.: 10):

  • Conversas longas com muito contexto acumulado
  • Agents de suporte com histórico rico de problemas

Quando usar uma similaridade mínima mais alta (ex.: 0.85):

  • Quando o Agent está recuperando fatos irrelevantes e "confundindo" as conversas de clientes diferentes

Saiba mais