Segundo cérebro com IA · Capítulo 13 de 16 · 12 min
Qual ferramenta de memória serve para o agente da pousada
Case a memória com o tipo de conversa que o agente tem com os hóspedes.
Este capítulo faz parte do curso gratuito Segundo cérebro com IA. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
Escolha a ferramenta de memória pelo tipo de conversa que o agente tem com os clientes e entreviste cada candidata com cinco perguntas antes de assinar. Voz pede uma coisa, preço que muda pede outra e ideias que se ligam pedem uma terceira; o placar do fornecedor vem depois.
Antes de começar, tenha o resultado das dez perguntas de busca, a lista das conversas que mais pesam na agenda (telefone, WhatsApp, e-mail) e a prova do negócio com as respostas certas. Na ligação, o agente de voz (assistente que atende por telefone e responde falando) lê a ficha antes de responder e anota o que mudou só depois, sem segurar a fala.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
O desenho separa os dois caminhos porque eles têm pressa diferente. O nome técnico da espera é escrita assíncrona: o agente anota depois, sem fazer o cliente esperar, como a recepcionista que desliga o telefone e só então passa o recado a limpo.
Por que a memória pode deixar o hóspede esperando no telefone?
A memória faz o cliente esperar quando grava a ficha no meio da ligação, porque gravar dá mais trabalho que ler. Na plataforma da Mem0, empresa que vende memória para agentes, adicionar uma lembrança é sempre assíncrono: o pedido volta na hora com um número de protocolo, e o processamento termina depois. Na integração com o Pipecat, programa usado para montar agentes de voz, a memória é consultada a cada fala, e a gravação roda em segundo plano.
Que gravar pesa mais que consultar tem medição acadêmica. Pesquisadores com Yasmine Omri como primeira autora mediram dez sistemas de memória em 2026: na maioria dos que usam um modelo de linguagem para montar a memória, a energia gasta nessa montagem passou da energia de responder a 300 consultas. A recomendação dos autores é tratar a escrita como trabalho de fundo, fora da conversa.
Onde a gravação acontece durante a ligação
Gravar a ficha no meio da ligação
Coluna a evitar
- O hóspede espera em silêncio enquanto a ficha é gravada
- Cada fala nova disputa tempo com a gravação da anterior
- Uma gravação lenta atrasa a resposta seguinte
Ler antes e gravar depois
Coluna recomendada
- A ficha chega pronta antes da primeira fala
- O que mudou é gravado em segundo plano
- Você confere a ficha atualizada no fechamento do dia
Do lado esquerdo está o erro que custa a ligação; do direito, o jeito que mantém a conversa andando. No telefone pesa também a demora: a Daily, empresa por trás do Pipecat, recomenda mirar 800 milissegundos na mediana, do fim da fala do cliente ao começo da resposta. Por isso a ficha chega pronta: um gancho, comando que dispara sozinho quando a ligação entra, busca a ficha pelo número de quem liga e a põe na mesa antes da primeira fala.
Como saber a hora de subir um degrau
Suba um degrau só quando o de baixo para de responder às perguntas dos clientes, e antes teste o de baixo com busca melhor. O degrau de baixo rende mais do que parece: em agosto de 2026, pesquisadores da Universidade de Ciência e Tecnologia da China deixaram as conversas cruas, sem resumo nem grafo, e deram ao agente uma busca por palavra que ele mesmo repete. Com o GPT-4o-mini, o agente acertou 58,2 em cerca de 2.800 perguntas, contra 53,2 do melhor sistema com grafo no mesmo modelo.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Cada degrau tem um sinal de que deixou de bastar. O arquivo de texto cansa quando passa do tamanho que o assistente lê bem, e o curso “Claude Code CLI: Programação com IA” ensina a escrevê-lo no formato do CLAUDE.md, o manual que o Claude lê. O RAG (o assistente busca trechos nos seus documentos antes de responder) cansa quando os fatos mudam muito ou quando a pergunta pede juntar o acervo inteiro.
A memória gerenciada, em que um serviço extrai e guarda os fatos sozinho, entra quando ninguém quer cuidar do arquivo à mão. A memória como sistema operacional, do Letta, antigo MemGPT, mantém blocos sempre à vista e busca o resto quando precisa. O grafo temporal fecha a escada, para fatos que mudam de data, e nos degraus de cima a escolha costuma ficar entre duas marcas.
Mem0 e Zep pelo tipo de conversa
| O que pesa | Mem0 | Zep |
|---|---|---|
| Como guarda | Só acrescenta; preço que muda pede filtro por data | Mapa de fatos, cada um com duas datas |
| Quando grava | Sempre em segundo plano | Chama o modelo a cada gravação |
| Bom para | Conversa por voz | Preço e regra que mudam de data |
Na tabela, cada marca cobra de um jeito. O Zep guarda um grafo de conhecimento temporal (mapa de fatos ligados em que cada ligação tem data): quando a diária muda, o fato antigo ganha data de fim e continua guardado, ao preço de uma chamada ao modelo a cada gravação.
A Mem0 atual extrai as lembranças numa única chamada e só acrescenta, sem apagar nem reescrever. Quando o fato muda, isso pesa: num teste de agosto de 2026 com a regra invertida por completo, a memória que só acrescentava acertou 0,210, abaixo dos 0,309 de um agente sem memória, e a que fechava o fato velho pela mesma chave, proposta pelos autores, chegou a 0,950.
O A-Mem, de pesquisadores ligados à Rutgers University, segue o Zettelkasten (método de fichas ligadas umas às outras, como caderno com remissões). Cada lembrança vira uma nota ligada a outras, e a nota nova pode reescrever a descrição das antigas. A conta cai na hora de responder e sobe na hora de guardar, porque cada nota nova pede ao modelo que crie as ligações.
A-Mem e arquivo de texto pelo tipo de lembrança
| O que pesa | A-Mem | Arquivo de texto |
|---|---|---|
| Como guarda | Notas ligadas umas às outras | Um arquivo por assunto |
| Quando custa | Ao guardar, para criar as ligações | Só o texto que o assistente lê |
| Bom para | Ideias que se ligam | Preferências e regras da casa |
Outras opções abertas completam o mapa: o Graphiti é o motor aberto por trás do Zep, e o LangMem, da LangChain, extrai e atualiza fatos em segundo plano. O comum a qualquer negócio, como banco de dados e busca por palavra, você aproveita pronto; o que só o seu negócio sabe, como quanto tempo cada lembrança vale, o técnico escreve. O projeto aberto memoria-nox, memória num só arquivo SQLite, segue esse corte.
Como entrevistar a ferramenta antes de assinar
Entreviste a ferramenta com cinco perguntas e peça para ver cada resposta funcionando, na sua prova. Antes de assinar, o curso “Do Agile ao Agentic Operating Model” ensina a saber quem opera os seus agentes, quanto custa e como trocar.
Entrevistar a ferramenta de memória antes de assinar
Passo 1: Pergunte como ela acha um trecho exato, como o número de uma reserva
Deu certo quando: A resposta cita busca por palavra ou por texto completo, e não só por sentido.
Passo 2: Pergunte como ela responde ao que pede o histórico inteiro
Por exemplo, quantos clientes voltaram em três feriados.
Deu certo quando: A resposta diz como ela junta o acervo, ou admite que não junta.
Passo 3: Pergunte o que acontece quando um fato muda e depende de outro
É a competência em que todos os sistemas medidos na prova MemoryAgentBench, da Universidade da Califórnia em San Diego, falharam.
Erro comum: O erro mais comum é aceitar “a memória se atualiza sozinha”. Peça para ver a ficha antes e depois de uma troca de preço.
Passo 4: Pergunte como você apaga uma lembrança errada sem perder as outras
Num teste de julho de 2026, a capacidade de consertar só a lembrança errada variou muito de uma pilha de memória para outra.
Deu certo quando: Você vê, na tela, uma lembrança sair e as outras continuarem.
Passo 5: Pergunte quando ela grava, durante a conversa ou depois
Deu certo quando: Na ligação, a gravação roda em segundo plano.
Passo 6: Rode a prova do negócio na ferramenta, e não o placar do fornecedor
Deu certo quando: Você tem um número seu, com as mesmas perguntas da linha de partida.
No fim você tem: Cinco respostas escritas, cada uma vista funcionando, e o resultado da ferramenta na sua prova.
Se a conversa que mais pesa é o telefone, escolha a ferramenta que grava em segundo plano; se é preço que muda de data, a que fecha a validade do fato velho; se são regras curtas, fique no arquivo de texto. Se a ferramenta não mostra como apagar uma lembrança sem apagar as outras, ela sai da lista. O cartão resume a escolha.
Escolha a memória pela conversa
O tipo de conversa decide a ferramenta, e o placar do fornecedor vem depois.
- Voz pede a ficha pronta antes da fala e a gravação depois
- Fato que muda de data pede mapa de fatos com datas
- Ideias que se ligam pedem notas ligadas
- Regras curtas cabem num arquivo de texto
alexandrecaramaschi.com/educacao/frontends-com-vibecoding
Para conferir a gravação na ferramenta escolhida, ligue para o agente três vezes com um pedido que muda a ficha, como um horário de chegada, e cronometre o silêncio depois de cada fala. Se o silêncio crescer, a ferramenta está gravando durante a ligação. Está pronto quando você tem as cinco respostas escritas, a prova do negócio rodada na ferramenta e o silêncio ao telefone sem crescer.
Cada lembrança gravada custa tokens, e um agente que atende o dia inteiro gasta de um jeito que o chat não mostra: o curso “LLM FinOps: o custo da IA para quem assina o orçamento” mostra por que a conta do agente foge da conta do chat. Quando um fornecedor aparecer com um placar de acerto, abra “Ler um placar de memória sem ser enganado” e leve o número junto.
Seu caderno neste capítulo
Abrir o caderno completoSelecione um trecho do capítulo para destacar ou anotar. Nos vídeos e áudios, use Anotar este momento. No teclado, selecione com Shift e as setas e use Alt+Shift+D para destacar ou Alt+Shift+N para anotar.
Salvo neste navegador. Entre na sua conta para levar o caderno a outros aparelhos.
Entre na sua conta para compartilhar o que aprendeu e convidar alguém para estudar com você.
Conexões deste capítulo
Explore os conceitos e compare abordagens em outros cursos. As conexões indicam assuntos relacionados; a sequência de estudo continua no índice do curso.
Conceitos deste capítulo
O mesmo assunto em outros cursos
- Prompt Engineering para ExecutivosEscolher a técnica para fluxos que rodam por horasExaminar conexões de Escolher a técnica para fluxos que rodam por horas
- Agentes de IA Autônomos: Do Conceito à ProduçãoMemória de curto e longo prazoExaminar conexões de Memória de curto e longo prazo
- Saúde Mental para Autistas em IAQual assistente aguenta ser prótese de função executivaExaminar conexões de Qual assistente aguenta ser prótese de função executiva
- RAG em produçãoContexto de um milhão de tokens não aposentou a recuperaçãoExaminar conexões de Contexto de um milhão de tokens não aposentou a recuperação
Voltar ao capítulo anterior: Achar a lembrança certa entre milhares de conversas
Capítulos vizinhos em Segundo cérebro com IA
- 11Quando o preço do feriado muda, o agente fica sabendo?
- 12Achar a lembrança certa entre milhares de conversas
- 13Qual ferramenta de memória serve para o agente da pousada
- 14Ler um placar de memória sem ser enganado
- 15Onde buscar ajuda no Brasil para montar o seu agente