Memória Eficiente em Tokens para Agentes de IA — 22% Menos Tokens que JSON
Por que a Eficiência em Tokens Importa
Seção intitulada “Por que a Eficiência em Tokens Importa”Cada token que seu agente IA processa custa dinheiro e leva tempo. Quando um agente lê arquivos de memória no início da sessão, o formato desses arquivos impacta diretamente:
- Custo — menos tokens = contas de API menores
- Velocidade — menos tokens = respostas mais rápidas
- Janela de contexto — menos tokens = mais espaço para trabalho real
O toon-memory usa o formato TOON (Token-Oriented Object Notation) que é:
- 22% mais eficiente que JSON para LLMs
- Otimizado para compreensão de IA — projetado para como LLMs processam informações
- Sem perdas — sem perda de dados, suporte completo ida e volta
Benchmarks de Eficiência em Tokens
Seção intitulada “Benchmarks de Eficiência em Tokens”Eficiência em Nível de Arquivo
Seção intitulada “Eficiência em Nível de Arquivo”Formato Tokens (16 entradas) vs JSON────────────── ─────────────────── ───────JSON 1097 referênciaTOON 850 -22,5%Impacto em Nível de Sessão
Seção intitulada “Impacto em Nível de Sessão”Método Tokens para obter contexto vs re-ler arquivos──────────────────────────── ───────────────────── ───────────────────Re-ler arquivos-fonte ~3000 referênciamemory_recall (flat) ~1200 -60%memory_recall (graph, compact) ~900 -70%memory_smart_recall ~850 -72%Benchmark de Sessão Completa
Seção intitulada “Benchmark de Sessão Completa”Simula uma sessão completa de agente em 5 fases:
Fase Sem memória Com memory_recall Com ferramentas context_*───────────────────────────────────── ───────────────── ───────────────── ─────────────────Fase 1: Início da Sessão 516 t / 6 c 409 t / 3 c 373 t / 1 cFase 2: Depurar Problema 176 t / 4 c 182 t / 2 c 252 t / 1 cFase 3: Implementar Feature 189 t / 6 c 183 t / 3 c 305 t / 1 cFase 4: Revisão de Código 316 t / 4 c 130 t / 2 c 243 t / 1 cFase 5: Encerramento 1.214 t / 5 c 68 t / 2 c 117 t / 1 c───────────────────────────────────── ───────────────── ───────────────── ─────────────────TOTAL 2.411 t / 25 c 972 t / 12 c 1.290 t / 5 cResultados:
| Métrica | Sem memória | Com memory_recall | Com ferramentas context_* |
|---|---|---|---|
| Tokens por sessão | 2.411 | 972 (-60%) | 1.290 (-47%) |
| Chamadas de ferramenta por sessão | 25 | 12 (-52%) | 5 (-80%) |
| Custo por sessão (GPT-4) | $0,072 | $0,029 | $0,039 |
Como o Formato TOON Funciona
Seção intitulada “Como o Formato TOON Funciona”JSON Tradicional
Seção intitulada “JSON Tradicional”{ "id": "a1b2c3d4", "category": "decision", "key": "use-zod", "content": "Use Zod for validation", "file": "src/types.ts", "tags": "validation;types", "date": "2026-07-10"}Formato TOON
Seção intitulada “Formato TOON”a1b2c3d4|decision|use-zod|Use Zod for validation|src/types.ts|validation;types|2026-07-10O formato TOON:
- Usa
|como delimitador (menos tokens que"e:e,) - Sem aspas em torno das strings
- Sem chaves
- Compacto mas ainda legível por humanos
Modos de Recall Eficientes em Tokens
Seção intitulada “Modos de Recall Eficientes em Tokens”Modo Flat (Padrão)
Seção intitulada “Modo Flat (Padrão)”memory_recall({ query: "redis" })// Retorna entradas correspondentes com detalhes completosModo Grafo
Seção intitulada “Modo Grafo”memory_recall({ query: "redis", mode: "graph", hops: 2 })// Expande entradas relacionadas via conexões do grafoModo Compacto
Seção intitulada “Modo Compacto”memory_recall({ query: "redis", compact: true })// Retorna entradas com índice numérico, remove id/date/file// Arestas do grafo são renderizadas como ->2, ->3Smart Recall (Recomendado)
Seção intitulada “Smart Recall (Recomendado)”memory_smart_recall({ intent: "database configuration" })// Combina BM25 + grafo + qualidade em uma chamada// Use no INÍCIO de cada tarefaQuando Usar Cada Modo
Seção intitulada “Quando Usar Cada Modo”| Modo | Melhor para | Custo em tokens |
|---|---|---|
| Flat | Busca simples por palavra-chave | Médio |
| Grafo | Decisões interconectadas | Baixo (compacto) |
| Compacto | Contextos com poucos tokens | Mínimo |
| Smart | Termos de busca desconhecidos | Médio (abrangente) |
Calculadora de Economia
Seção intitulada “Calculadora de Economia”Considerando preços do GPT-4 ($0,03/1K tokens de entrada):
| Cenário | Sem memória | Com toon-memory | Economia |
|---|---|---|---|
| 10 sessões/dia | $0,72/dia | $0,29/dia | $0,43/dia |
| 30 sessões/mês | $21,60/mês | $8,70/mês | $12,90/mês |
| 365 sessões/ano | $262,80/ano | $105,85/ano | $156,95/ano |
Comece Agora
Seção intitulada “Comece Agora”npm install -g toon-memorynpx toon-memory # Instalador interativoSeu agente usará memória eficiente em tokens na próxima sessão.