Où vit réellement la mémoire de votre IA ?
Une couche de mémoire, c'est une base de données de tout ce que vous avez dit à un assistant. Donc la chose la plus sensible de votre stack, et la moins documentée.
Publié le 22 septembre 2026 · 7 min de lecture
Regardez ce qui s'accumule dans une mémoire IA après trois mois d'usage réel : des noms de clients, des termes de contrat, des discussions de salaire, l'architecture de systèmes dont vous êtes responsable, ce détail médical mentionné une fois pour expliquer un retard. Ce n'est pas un cache. C'est un dossier, et vous l'avez constitué en étant utile à vous-même.
Maintenant répondez à trois questions dessus. Dans quel pays sont ces données ? Qui peut les lire ? Qu'est-ce qu'elles deviennent si la boîte ferme l'an prochain ? La plupart des produits de mémoire ne rendent pas ces réponses faciles à trouver, et certains ne peuvent tout simplement pas répondre à la première.
Ce que dit vraiment le RGPD (et ce qu'il ne dit pas)
Le RGPD n'interdit pas de stocker des données hors d'Europe, et qui vous vend « hébergement UE ou vous êtes illégal » en fait trop. Ce qu'il exige, c'est une base légale, une finalité limitée, une sécurité proportionnée au risque et — quand des données personnelles quittent l'EEE — un mécanisme de transfert valide avec des garanties qui tiennent réellement.
C'est ce dernier point qui coince. Dans Schrems II, la Cour de justice a invalidé le Privacy Shield et posé clairement qu'une clause contractuelle ne sert à rien si le droit de surveillance du pays de destination passe par-dessus. Les recommandations du CEPD qui ont suivi ont poussé les responsables de traitement vers des mesures techniques supplémentaires — ce qui, en pratique, veut souvent dire : gardez ça en Europe, ou chiffrez-le de sorte que le prestataire ne puisse pas le lire.
Deux conséquences qui comptent au moment de choisir un service de mémoire :
- Si vous êtes une entreprise et que vous traitez des données clients, le stockage de mémoire est un sous-traitant ultérieur. Il vous faut un DPA, et il vous faut savoir où il tourne — pas par pureté, mais parce que vos propres clients vont le demander.
- Si vous êtes un particulier, rien de tout ça n'est une obligation légale pour vous. Ça reste la différence entre des données sous juridiction européenne et des données sous celle de quelqu'un d'autre.
« Conforme RGPD » est une affirmation, pas un certificat
Aucun organisme ne délivre de certification RGPD. Quand un éditeur écrit « conforme RGPD » sur sa page tarifaire, c'est une auto-déclaration. Elle peut être parfaitement vraie. Ce n'est pas une preuve.
SOC 2 et ISO 27001, eux, *sont* audités et valent quelque chose — mais ils vérifient qu'une entreprise fait ce qu'elle dit, pas où sont vos octets ni si cette réponse vous convient. Un rapport SOC 2 Type 2 et un hébergement exclusivement américain cohabitent très bien.
Alors ignorez les badges et demandez du concret :
- Dans quel pays se trouvent la base de production et ses sauvegardes ? Nommez l'hébergeur et la région.
- Qui a un accès technique au clair, selon quelle procédure, et cet accès est-il journalisé ?
- Y a-t-il un DPA à signer, et liste-t-il les sous-traitants ultérieurs ?
- Comment l'isolation entre clients est-elle imposée : par le code applicatif, ou par la base de données ?
- Chiffrement au repos : au niveau du disque, ou le prestataire ne peut-il pas lire mes lignes du tout ? Ce sont deux garanties très différentes.
- Si je partais : format d'export, délai de suppression, et la suppression couvre-t-elle les sauvegardes ?
Un éditeur incapable de répondre à six questions factuelles sur sa propre infrastructure vous a appris quelque chose d'utile.
La question d'isolation que personne ne pose
Un service multi-client sépare ses clients de l'une de deux façons. Soit le code applicatif filtre par client à chaque requête, soit la base de données elle-même refuse de renvoyer les lignes d'un autre.
La première est normale et fonctionne — jusqu'à ce qu'une requête sur dix mille oublie le filtre. Cette famille de bugs est derrière une bonne part des incidents « on a vu les données d'un autre utilisateur » dont vous avez entendu parler. La seconde coûte plus cher à construire et échoue du bon côté : un filtre manquant ne renvoie rien, au lieu de renvoyer les souvenirs de quelqu'un d'autre.
C'est une question légitime, et la réponse vous dit comment l'équipe pense le mode de défaillance.
Zéro-connaissance : utile, rare, et très souvent mal décrit
La réponse la plus forte possible, c'est que le prestataire ne détient aucune clé et ne peut mathématiquement pas lire vos données. Très peu de produits de mémoire le proposent, pour une raison ennuyeuse : la recherche sémantique doit calculer sur le contenu. Vous pouvez chiffrer des blobs que le serveur ne lit pas, mais il faut bien que quelque chose calcule les embeddings et le classement — et ce quelque chose a besoin du clair : sur votre appareil, ou pas du tout.
Donc quand vous voyez « chiffré de bout en bout » sur un service de mémoire qui fait aussi de la recherche sémantique côté serveur, lisez de près. Souvent ça veut dire TLS en transit et chiffrement au repos avec une clé détenue par le prestataire. C'est une architecture raisonnable. Ce n'est pas du zéro-connaissance, et les deux sont confondus en permanence — y compris, pour être direct, dans les textes marketing de toute cette catégorie.
Ce qu'on fait, et ce qu'on ne fait pas
Pryzm tourne chez Hetzner, en Allemagne. Le volume qui porte la base est chiffré au repos au niveau du bloc. Chaque client a son propre schéma et son propre rôle PostgreSQL, donc l'isolation est imposée par le moteur de base de données et non par notre code applicatif. Les sauvegardes restent dans l'UE. La juridiction est européenne, et il n'y a pas de maison mère américaine dans la chaîne.
Ce qu'on ne revendique pas : le zéro-connaissance. Un accès administrateur technique aux serveurs existe — on n'exploite pas une base qu'on ne peut jamais toucher — il est restreint et journalisé. Notre mode Scellé, où nous ne détenons aucune clé, est annoncé et pas livré ; on l'écrit comme ça sur le site et on continuera de l'écrire comme ça jusqu'à ce qu'il sorte.
Si vous préférez ne faire confiance à aucun prestataire, plusieurs serveurs de mémoire auto-hébergeables sont bons et gratuits : on les liste dans notre comparatif des alternatives. Héberger vous-même est la réponse la plus forte à tout cet article.