Servidor MCP de Memória: Guia Completo de Memória Persistente de IA
O que é um Servidor MCP de Memória?
Seção intitulada “O que é um Servidor MCP de Memória?”Um servidor MCP de memória é um serviço local que implementa o Model Context Protocol (MCP) para fornecer aos agentes de codificação com IA memória persistente. Em vez de perder contexto entre sessões, seu agente armazena decisões, padrões e bugs em um armazenamento de memória pesquisável.
O toon-memory é o servidor MCP de memória mais completo disponível:
- 35 ferramentas MCP + 4 recursos
- Suporte a 15+ agentes — Claude, Cursor, OpenCode e mais
- Formato eficiente em tokens — 22% menos tokens que JSON
- Recall consciente de grafo — BM25 + centralidade + pontuação de qualidade
- Zero configuração — instale e use
Como Servidores MCP de Memória Funcionam
Seção intitulada “Como Servidores MCP de Memória Funcionam”O Model Context Protocol
Seção intitulada “O Model Context Protocol”O MCP (Model Context Protocol) é um padrão para agentes de IA se comunicarem com ferramentas externas. Um servidor MCP de memória:
- Recebe requisições do agente via stdio
- Processa operações de memória (salvar, buscar, deletar)
- Armazena dados localmente em formato estruturado
- Retorna resultados formatados para o agente
Arquitetura
Seção intitulada “Arquitetura”Seu Agente IA ↓ Protocolo MCP (stdio)Servidor de Memória (toon-memory) ↓Arquivo Local (.toon-memory/memory/data.toon)Sem nuvem. Sem chamadas de API. Sem rede. Tudo fica na sua máquina.
Por que Usar um Servidor MCP de Memória?
Seção intitulada “Por que Usar um Servidor MCP de Memória?”O Problema
Seção intitulada “O Problema”Agentes de codificação com IA não têm memória entre sessões:
- Claude esquece as decisões de arquitetura de ontem
- Cursor não consegue relembrar as correções de bug que você descobriu
- OpenCode não lembra dos padrões que sua equipe estabeleceu
Isso desperdiça tokens, gasta tempo e leva a repetições frustrantes.
A Solução
Seção intitulada “A Solução”Um servidor MCP de memória dá ao seu agente memória persistente:
| Sem Memória MCP | Com Memória MCP |
|---|---|
| Re-explicar contexto toda sessão | Contexto persiste automaticamente |
| 2.411 tokens por sessão | 972 tokens por sessão (-60%) |
| 25 chamadas de ferramenta por sessão | 5 chamadas de ferramenta por sessão (-80%) |
| $0,072 por sessão (GPT-4) | $0,029 por sessão (-60%) |
Funcionalidades do Servidor MCP de Memória
Seção intitulada “Funcionalidades do Servidor MCP de Memória”34 Ferramentas MCP
Seção intitulada “34 Ferramentas MCP”O toon-memory expõe 35 ferramentas MCP para gerenciamento completo de memória:
Ferramentas Principais:
memory_remember— Salvar decisões, padrões, bugs, conhecimentomemory_recall— Buscar na memória (modo flat ou grafo)memory_smart_recall— Recall unificado com BM25 + grafo + qualidadememory_forget— Remover entradasmemory_stats— Visualizar estado da memória
Ferramentas de Contexto:
context_brief— Briefing de contexto em uma chamadacontext_generate— Briefing completo do projetocontext_diff— O que mudou desde a última sessãocontext_focus— Briefing hiper-focadocontext_health— Auditoria de saúde da memóriacontext_export— Exportar como markdown
Ferramentas de Gerenciamento:
memory_summary— Salvar/recuperar resumos de arquivosmemory_archive— Arquivar entradas antigasmemory_diff— Mostrar mudanças desde uma datamemory_suggest— Encontrar entradas relacionadasmemory_sessions— Coordenação multi-sessãomemory_captured— Visualizar atividade capturada por hooksmemory_consolidate— Mesclar duplicatasmemory_encrypt— Criptografia AES-256-GCMmemory_decrypt— Desativar criptografia
Formato Eficiente em Tokens
Seção intitulada “Formato Eficiente em Tokens”A memória é armazenada em formato TOON (Token-Oriented Object Notation):
a1b2c3d4|decision|use-zod|Use Zod for validation|src/types.ts|validation;types|2026-07-1022% menos tokens que JSON equivalente, projetado para compreensão de LLM.
Recall Consciente de Grafo
Seção intitulada “Recall Consciente de Grafo”As entradas são conectadas via links explícitos e referências implícitas:
memory_remember({ category: "decision", key: "use-redis", content: "Use Redis for session storage (see [[redis-config]])", links: "redis-config"})O recall expande o ego-subgrafo para encontrar entradas relacionadas, mesmo que não contenham o termo de busca exato.
Pontuação de Qualidade
Seção intitulada “Pontuação de Qualidade”Cada entrada recebe uma pontuação de qualidade automática (0-1):
| Fator | Peso |
|---|---|
| Tags | 0,3 máx |
| Links | 0,2 máx |
| Comprimento do conteúdo | 0,3 máx |
| Atualidade | 0,1 máx |
| Especificidade | 0,1 máx |
Entradas de alta qualidade aparecem primeiro no recall.
Guia de Configuração
Seção intitulada “Guia de Configuração”Passo 1: Instalar
Seção intitulada “Passo 1: Instalar”npm install -g toon-memoryPasso 2: Configurar
Seção intitulada “Passo 2: Configurar”npx toon-memory # Instalador interativoOu adicione manualmente à configuração MCP do seu agente:
{ "mcpServers": { "toon-memory": { "command": "npx", "args": ["-y", "toon-memory", "mcp"] } }}Passo 3: Usar
Seção intitulada “Passo 3: Usar”# Salve decisões importantesmemory_remember({ category: "decision", key: "use-postgres", content: "Choose Postgres for ACID compliance"})
# Busque na memóriamemory_recall({ query: "database" })
# Obtenha o contexto completo em uma chamadamemory_smart_recall({ intent: "what I was working on" })Benchmarks
Seção intitulada “Benchmarks”Eficiência em Tokens
Seção intitulada “Eficiência em Tokens”Formato Tokens (16 entradas) vs JSON────────────── ─────────────────── ───────JSON 1097 referênciaTOON 850 -22,5%Eficiência do Recall
Seção intitulada “Eficiência do Recall”Método Tokens para obter contexto vs re-ler arquivos──────────────────────────── ───────────────────── ───────────────────Re-ler arquivos-fonte ~3000 referênciamemory_recall (flat) ~1200 -60%memory_recall (graph, compact) ~900 -70%memory_smart_recall ~850 -72%Benchmark das Ferramentas de Contexto
Seção intitulada “Benchmark das Ferramentas de Contexto”Cenário Sem Com Economia Ferramentas─────────────────────────────── ──────── ────── ─────── ──────context_generate (briefing completo) 5.556 378 93,2% 6 → 1context_diff (incremental) 533 152 71,5% 4 → 1context_focus (direcionado) 413 225 45,5% 4 → 1context_health (auditoria) 322 246 23,6% 5 → 1context_export (md injetável) 1.178 218 81,5% 3 → 1─────────────────────────────── ──────── ────── ─────── ──────TOTAL 8.002 1.219 84,8% 22 → 5Agentes Suportados
Seção intitulada “Agentes Suportados”O toon-memory funciona com mais de 15 agentes de codificação com IA:
- OpenCode, Claude Code, Cursor, Windsurf, VS Code Copilot
- Codex CLI, Gemini CLI, Zed, Cline, Continue
- Antigravity, Aider, KiloCode, OpenClaw, Kiro
Veja a página de Agentes Suportados para detalhes de configuração.
Conclusão
Seção intitulada “Conclusão”Um servidor MCP de memória dá ao seu agente de codificação com IA a memória persistente de que ele precisa para ser verdadeiramente produtivo. O toon-memory é a solução mais completa disponível:
- 35 ferramentas MCP para gerenciamento completo de memória
- Formato eficiente em tokens que economiza 22% em cada sessão
- Recall consciente de grafo que encontra contexto relacionado automaticamente
- Suporte a 15+ agentes com configuração zero
npm install -g toon-memorynpx toon-memory # Instalador interativoSeu agente vai lembrar de tudo na próxima sessão.