Pular para o conteúdo

Memória Eficiente em Tokens para Agentes de IA — 22% Menos Tokens que JSON

Cada token que seu agente IA processa custa dinheiro e leva tempo. Quando um agente lê arquivos de memória no início da sessão, o formato desses arquivos impacta diretamente:

  • Custo — menos tokens = contas de API menores
  • Velocidade — menos tokens = respostas mais rápidas
  • Janela de contexto — menos tokens = mais espaço para trabalho real

O toon-memory usa o formato TOON (Token-Oriented Object Notation) que é:

  • 22% mais eficiente que JSON para LLMs
  • Otimizado para compreensão de IA — projetado para como LLMs processam informações
  • Sem perdas — sem perda de dados, suporte completo ida e volta
Formato Tokens (16 entradas) vs JSON
────────────── ─────────────────── ───────
JSON 1097 referência
TOON 850 -22,5%
Método Tokens para obter contexto vs re-ler arquivos
──────────────────────────── ───────────────────── ───────────────────
Re-ler arquivos-fonte ~3000 referência
memory_recall (flat) ~1200 -60%
memory_recall (graph, compact) ~900 -70%
memory_smart_recall ~850 -72%

Simula uma sessão completa de agente em 5 fases:

Fase Sem memória Com memory_recall Com ferramentas context_*
───────────────────────────────────── ───────────────── ───────────────── ─────────────────
Fase 1: Início da Sessão 516 t / 6 c 409 t / 3 c 373 t / 1 c
Fase 2: Depurar Problema 176 t / 4 c 182 t / 2 c 252 t / 1 c
Fase 3: Implementar Feature 189 t / 6 c 183 t / 3 c 305 t / 1 c
Fase 4: Revisão de Código 316 t / 4 c 130 t / 2 c 243 t / 1 c
Fase 5: Encerramento 1.214 t / 5 c 68 t / 2 c 117 t / 1 c
───────────────────────────────────── ───────────────── ───────────────── ─────────────────
TOTAL 2.411 t / 25 c 972 t / 12 c 1.290 t / 5 c

Resultados:

Métrica Sem memória Com memory_recall Com ferramentas context_*
Tokens por sessão 2.411 972 (-60%) 1.290 (-47%)
Chamadas de ferramenta por sessão 25 12 (-52%) 5 (-80%)
Custo por sessão (GPT-4) $0,072 $0,029 $0,039
{
"id": "a1b2c3d4",
"category": "decision",
"key": "use-zod",
"content": "Use Zod for validation",
"file": "src/types.ts",
"tags": "validation;types",
"date": "2026-07-10"
}
a1b2c3d4|decision|use-zod|Use Zod for validation|src/types.ts|validation;types|2026-07-10

O formato TOON:

  • Usa | como delimitador (menos tokens que " e : e ,)
  • Sem aspas em torno das strings
  • Sem chaves
  • Compacto mas ainda legível por humanos
Terminal window
memory_recall({ query: "redis" })
// Retorna entradas correspondentes com detalhes completos
Terminal window
memory_recall({ query: "redis", mode: "graph", hops: 2 })
// Expande entradas relacionadas via conexões do grafo
Terminal window
memory_recall({ query: "redis", compact: true })
// Retorna entradas com índice numérico, remove id/date/file
// Arestas do grafo são renderizadas como ->2, ->3
Terminal window
memory_smart_recall({ intent: "database configuration" })
// Combina BM25 + grafo + qualidade em uma chamada
// Use no INÍCIO de cada tarefa
Modo Melhor para Custo em tokens
Flat Busca simples por palavra-chave Médio
Grafo Decisões interconectadas Baixo (compacto)
Compacto Contextos com poucos tokens Mínimo
Smart Termos de busca desconhecidos Médio (abrangente)

Considerando preços do GPT-4 ($0,03/1K tokens de entrada):

Cenário Sem memória Com toon-memory Economia
10 sessões/dia $0,72/dia $0,29/dia $0,43/dia
30 sessões/mês $21,60/mês $8,70/mês $12,90/mês
365 sessões/ano $262,80/ano $105,85/ano $156,95/ano
Terminal window
npm install -g toon-memory
npx toon-memory # Instalador interativo

Seu agente usará memória eficiente em tokens na próxima sessão.