Concevoir une mémoire multi-locataire et multiniveau pour les agents IA

10 août 2026 at 22:28
2 min read

L’expert en IA Alejandro Saucedo, qui exerce auprès de l’ONU, de la Commission européenne et de Zalando, a publié le second volet de sa série consacrée à la mémorisation des agents d’intelligence artificielle. Intitulée Whose Memory Is It? Building Multi-Tenant, Multi-Tier Memory for AI Agents (Part 2), cette parution détaille des choix de conception avancés pour la gestion de la persistance de la mémoire multi-locataire au sein du système d’orchestration d’agents Kubernetes Agent Orchestration System (KAOS).

Établissement d’un modèle de mémoire simplifié à trois niveaux

Dans la lignée du premier volet de la série — qui dressait un panorama d’environ 30 moteurs de mémoire et retenait Mem0 en tant que bibliothèque —, Saucedo a établi une architecture de mémoire simplifiée à trois niveaux. Ce cadre se compose d’une fenêtre à court terme, d’un résumé à moyen terme et de faits à long terme. Le niveau à court terme gère la fenêtre contextuelle de la session en direct, encadrée par un budget de jetons et actualisée à chaque tour au moyen de lignes relationnelles. Le niveau à moyen terme tient à jour un résumé évolutif par session, tandis que le niveau à long terme extrait des faits atomiques indexés par portée et les récupère sémantiquement grâce à des bases de données vectorielles.

Définition des périmètres d’accès et de la provenance des écritures

Chaque opération mémorielle au sein d’un système multi-locataire exige des frontières strictes en matière de propriété et de confidentialité des données. KAOS enregistre des métadonnées de provenance composées et invariantes pour chaque donnée mémorielle stockée, capturant l’identifiant utilisateur (user_id), l’identité de l’agent et l’identifiant de session. Concernant les opérations de lecture, une relation hiérarchique restreint l’accès en fonction de la posture de sécurité et des en-têtes de requêtes vérifiés. La vérification d’identité prévient les accès non autorisés, garantissant ainsi que les lectures utilisateur inter-agents ne se produisent que lorsque le propriétaire du stockage élève délibérément le seuil.

Enseignements architecturaux clés pour les systèmes de production

Ce cadre architectural offre des enseignements cruciaux pour le déploiement de couches de mémoire agentique à l’échelle. Les systèmes doivent traiter les fenêtres textuelles et les faits distillés inter-sessions comme des niveaux de mémoire distincts dotés de cycles de vie propres. En outre, la conservation d’enregistrements textuels durables garantit la résilience face à la perte d’extractions, tandis que la dérivation des périmètres côté serveur à partir d’une identité authentifiée prévient l’empoisonnement de la mémoire et les attaques par injection inter-sessions.