Vector store vs memory “vivante”

Reddit r/AI_Agents News

Summary

L'article clarifie la différence entre le RAG classique (stateless) et la mémoire d'agent (stateful), et présente deux approches émergentes : Mem0 avec une mémoire à trois niveaux et auto-édition, et Letta avec une mémoire façon OS (core/archive). Il souligne que le vrai défi est la logique de mise à jour et d'oubli, pas le stockage vectoriel.

Je vois encore beaucoup de posts/articles qui mettent “RAG” et “agent memory” dans le même panier, et je pense que ça mérite d’être clarifié parce que ce sont deux problèmes différents. Le RAG classique, c’est simple : tu chunkes des documents, tu les embed, tu retrouves les passages les plus proches sémantiquement de la requête. Ça marche super bien pour de la doc statique, mais c’est fondamentalement stateless — ça ne sait rien de “toi”, ni de ce qui s’est passé il y a 3 sessions. La mémoire d’agent, c’est un problème différent : il faut stocker le contexte qui évolue avec les interactions (préférences, faits appris, corrections), et surtout gérer la mise à jour, la traçabilité (provenance) et l’oubli — un simple vector store ne fait aucune de ces trois choses nativement. Deux façons de résoudre ça qu’on voit émerger : Mem0 : mémoire en 3 niveaux (user / session / agent), et quand deux faits se contredisent, le système auto-édite plutôt que d’empiler des doublons. L’idée c’est de garder la mémoire “propre” dans le temps. Letta : approche façon OS, une mémoire “core” toujours dans le contexte (comme de la RAM), et une mémoire archivée qu’on va chercher explicitement via des tool calls quand besoin. L’agent décide lui-même quoi garder en avant-plan vs quoi archiver. Bref, stocker des vecteurs c’est la partie facile. Le vrai game, c’est la logique de mise à jour et de décision, savoir quoi garder, quoi jeter, et comment corriger un fait sans dupliquer toute la base. Vous utilisez quoi en prod actuellement et est-ce que vous avez eu des galères avec la “dérive” de mémoire (contradictions qui s’accumulent, contexte qui explose) ?
Original Article

Similar Articles

Understanding Agent Memory (38 minute read)

TLDR AI

This article compares three common shapes of agent memory systems—file-based, structured store, and experience-based—and evaluates their effectiveness through a benchmark using a common agent loop and open-weight model.