Mémoire économe en tokens pour les agents IA — 22% de tokens en moins que le JSON
Pourquoi l’efficacité des tokens compte
Section intitulée « Pourquoi l’efficacité des tokens compte »Chaque token que votre agent IA traite coûte de l’argent et prend du temps. Lorsqu’un agent lit les fichiers mémoire au démarrage d’une session, le format de ces fichiers impacte directement :
- Coût — moins de tokens = factures API plus basses
- Vitesse — moins de tokens = réponses plus rapides
- Fenêtre de contexte — moins de tokens = plus de place pour le travail réel
toon-memory utilise le format TOON (Token-Oriented Object Notation) qui est :
- 22% plus efficace que le JSON pour les LLMs
- Optimisé pour la compréhension IA — conçu pour la façon dont les LLMs traitent l’information
- Sans perte — aucune perte de données, support d’aller-retour complet
Benchmarks d’efficacité des tokens
Section intitulée « Benchmarks d’efficacité des tokens »Efficacité au niveau fichier
Section intitulée « Efficacité au niveau fichier »Format Tokens (16 entrées) vs JSON────────────── ─────────────────── ───────JSON 1097 baselineTOON 850 -22.5%Impact au niveau session
Section intitulée « Impact au niveau session »Méthode Tokens pour obtenir le contexte vs relire les fichiers────────────────────────────── ────────────────────────── ──────────────────────Relire les fichiers source ~3000 baselinememory_recall (plat) ~1200 -60%memory_recall (graphe, compact) ~900 -70%memory_smart_recall ~850 -72%Benchmark de session complète
Section intitulée « Benchmark de session complète »Simule une session d’agent complète en 5 phases :
Phase Sans mémoire Avec memory_recall Avec outils context_*───────────────────────────────────── ───────────────── ───────────────── ─────────────────────Phase 1: Début de session 516 t / 6 c 409 t / 3 c 373 t / 1 cPhase 2: Débogage 176 t / 4 c 182 t / 2 c 252 t / 1 cPhase 3: Implémentation 189 t / 6 c 183 t / 3 c 305 t / 1 cPhase 4: Revue de code 316 t / 4 c 130 t / 2 c 243 t / 1 cPhase 5: Clôture 1 214 t / 5 c 68 t / 2 c 117 t / 1 c───────────────────────────────────── ───────────────── ───────────────── ─────────────────────TOTAL 2 411 t / 25 c 972 t / 12 c 1 290 t / 5 cRésultats :
| Métrique | Sans mémoire | Avec memory_recall | Avec outils context_* |
|---|---|---|---|
| Tokens par session | 2 411 | 972 (-60%) | 1 290 (-47%) |
| Appels d’outils par session | 25 | 12 (-52%) | 5 (-80%) |
| Coût par session (GPT-4) | 0,072 $ | 0,029 $ | 0,039 $ |
Comment le format TOON fonctionne
Section intitulée « Comment le format TOON fonctionne »JSON traditionnel
Section intitulée « JSON traditionnel »{ "id": "a1b2c3d4", "category": "decision", "key": "use-zod", "content": "Use Zod for validation", "file": "src/types.ts", "tags": "validation;types", "date": "2026-07-10"}Format TOON
Section intitulée « Format TOON »a1b2c3d4|decision|use-zod|Use Zod for validation|src/types.ts|validation;types|2026-07-10Le format TOON :
- Utilise
|comme délimiteur (moins de tokens que"et:et,) - Pas de guillemets autour des chaînes
- Pas d’accolades
- Compact mais toujours lisible par les humains
Modes de rappel économes en tokens
Section intitulée « Modes de rappel économes en tokens »Mode plat (défaut)
Section intitulée « Mode plat (défaut) »memory_recall({ query: "redis" })// Returns matching entries with full detailsMode graphe
Section intitulée « Mode graphe »memory_recall({ query: "redis", mode: "graph", hops: 2 })// Expands related entries via graph connectionsMode compact
Section intitulée « Mode compact »memory_recall({ query: "redis", compact: true })// Returns numeric-indexed entries, drops id/date/file// Graph edges render as ->2, ->3Rappel intelligent (Recommandé)
Section intitulée « Rappel intelligent (Recommandé) »memory_smart_recall({ intent: "database configuration" })// Combines BM25 + graph + quality in one call// Use at the START of every taskQuand utiliser chaque mode
Section intitulée « Quand utiliser chaque mode »| Mode | Idéal pour | Coût en tokens |
|---|---|---|
| Plat | Recherche par mots-clés simple | Moyen |
| Graphe | Décisions interconnectées | Faible (compact) |
| Compact | Contextes à tokens limités | Le plus faible |
| Intelligent | Termes de recherche inconnus | Moyen (complet) |
Calculatrice d’économies
Section intitulée « Calculatrice d’économies »En supposant la tarification GPT-4 (0,03 $/1K tokens d’entrée) :
| Scénario | Sans mémoire | Avec toon-memory | Économies |
|---|---|---|---|
| 10 sessions/jour | 0,72 $/jour | 0,29 $/jour | 0,43 $/jour |
| 30 sessions/mois | 21,60 $/mois | 8,70 $/mois | 12,90 $/mois |
| 365 sessions/an | 262,80 $/an | 105,85 $/an | 156,95 $/an |
Commencer
Section intitulée « Commencer »npm install -g toon-memorynpx toon-memory # Installateur interactifVotre agent utilisera une mémoire économe en tokens dans la prochaine session.