Alle Artikel

So geben Sie Ihren KI-Assistenten ein gemeinsames Gedächtnis

Jeder Assistent hat inzwischen sein eigenes Gedächtnis, und keiner teilt es. Ein entfernter MCP-Server ist das Teil, das dieses Problem löst.

Veröffentlicht am 22. September 2026 · 6 Min. Lesezeit

Sie erklären einem Assistenten Ihren Stack, Ihre Kunden, Ihre Einschränkungen. Zwei Wochen später wechseln Sie zu einem anderen Modell, weil es besser in dem ist, was Sie jetzt brauchen — und Sie fangen bei null an. Das Gedächtnis, das Sie aufgebaut haben, gehört nicht Ihnen: Es lebt in einem Produkt.

Das ist das eigentliche Problem. Es liegt nicht daran, dass Assistenten vergessen: Die meisten erinnern sich inzwischen recht gut. Es liegt daran, dass jeder sich getrennt erinnert, in einem Speicher, den Sie weder lesen noch verschieben noch anderswohin richten können.

Eingebautes Gedächtnis gegen ein Gedächtnis, das Ihnen gehört

Native Gedächtnisfunktionen sind bequem und kosten nichts. Sie haben außerdem drei Eigenschaften, die man nüchtern betrachten sollte: Der Anbieter entscheidet, was gemerkt wird, die Daten bleiben bei diesem Anbieter, und nichts davon geht mit, wenn Sie gehen. Für gelegentliche Nutzung ist das ein fairer Handel. Für Arbeit, auf der Sie jahrelang aufbauen, ist es eine Bindung, die Sie gewählt haben, ohne es zu merken.

Die Alternative besteht darin, das Gedächtnis außerhalb aller Assistenten zu halten und jeden daraus lesen zu lassen. Dafür braucht es ein Protokoll, auf das sich beide Seiten einigen — und genau da kommt MCP ins Spiel.

Was MCP tatsächlich ist

Das Model Context Protocol ist ein offener Standard, um einen Assistenten mit externen Tools und Daten zu verbinden. Anthropic hat es veröffentlicht, und es wird seither weit über Claude hinaus eingesetzt. Aus Sicht des Modells ist ein MCP-Server nichts weiter als eine Menge aufrufbarer Tools: Speichere dies, suche jenes.

Ein Memory-Server stellt etwa vier Tools bereit — eine Erinnerung schreiben, Erinnerungen durchsuchen, ein Projekt auflisten, das gerade Relevante hervorholen — und der Assistent ruft sie von sich aus auf, wenn ein Gespräch es verlangt. Sie fügen keinen Kontext mehr ein; das Modell holt ihn sich.

MCP-Server gibt es in zwei Ausprägungen, und dieser Unterschied wiegt schwerer als jeder Funktionsvergleich:

  • Lokal (stdio). Der Server läuft als Prozess auf Ihrer Maschine. Schnell, privat, kostenlos — und unsichtbar für alles, was keine Desktop-Anwendung auf dieser Maschine ist. Nicht für Ihr Telefon, nicht für einen Browser-Tab.
  • Entfernt (HTTP + OAuth). Der Server lebt unter einer URL. Jeder Client, der entfernte Connectors unterstützt, kann sich anmelden und ihn nutzen, von jedem Gerät aus.

Wenn Sie ein Gedächtnis wollen, das über Assistenten und Geräte hinweg geteilt wird, brauchen Sie die zweite Sorte. Wenn Sie ein Gedächtnis auf einem Laptop wollen, das diesen nie verlässt, ist die erste ehrlich gesagt die bessere Antwort — und sie ist kostenlos.

Wie ein entferntes Gedächtnis angebunden wird

Es gibt nichts zu installieren. Ein entfernter MCP-Server ist eine URL plus eine OAuth-Anmeldung, derselbe Ablauf wie das Verbinden eines Kalenders mit einer App:

  1. Fügen Sie die Server-URL in die Connector-Einstellungen Ihres Clients ein.
  2. Der Client ruft die OAuth-Metadaten des Servers ab und registriert sich selbst.
  3. Sie bestätigen den Zugriff einmalig in einem Browserfenster.
  4. Die Tools erscheinen. Der Assistent beginnt, sie aufzurufen, wenn es passt.

Wiederholen Sie Schritt eins in einem zweiten Client, und beide lesen und schreiben ab jetzt dasselbe Gedächtnis. Das ist der ganze Trick: Das Gedächtnis ist ein Dienst, keine Datei. Unsere eigene Schritt-für-Schritt-Fassung, mit Screenshots je Client, steht in der Verbindungsanleitung.

Speichern ist leicht. Das Produkt ist das Wiederfinden.

Text an eine Datenbank anzuhängen kann alles. Schwierig ist die Antwort auf die Frage, Monate später und mitten in einem Gespräch ohne Bezug, welche fünf Ihrer viertausend Notizen jetzt zählen. Wenn das schiefgeht, haben Sie ein Archiv gebaut, das niemand liest.

Zwei Arten zu scheitern, beide häufig:

  • Reine Stichwortsuche verfehlt alles, was anders formuliert ist als das, was Sie gespeichert haben.
  • Reine Vektorsuche liefert Dinge, die vage zum Thema passen, und verfehlt genaue Namen, Fehlercodes und Kennungen — genau die Details, die Sie brauchten.

Ernsthafte Implementierungen führen beides aus und verschmelzen die Ranglisten — Reciprocal Rank Fusion ist die übliche Methode — und bewerten die engere Auswahl anschließend mit einem Reranking-Modell neu, das Frage und Kandidat wirklich zusammen liest. Das kostet mehr pro Anfrage und ist der Unterschied zwischen einem Gedächtnis und einem Haufen.

Wenn Sie in mehr als einer Sprache arbeiten, prüfen Sie genau diesen Punkt. Eine auf englische Embeddings abgestimmte Kette verschlechtert sich im Französischen oder Deutschen still und leise, und der Fehler ist unsichtbar: Sie bekommen einfach schlechtere Ergebnisse und nehmen an, Sie hätten die Notiz schlecht geschrieben.

Fünf Fragen, bevor Sie sich festlegen

  1. Lokal oder entfernt? Klären Sie das zuerst. So oder so fällt der größte Teil des Marktes weg.
  2. Wo liegen die Daten, und unter welcher Rechtsordnung? Steht die Antwort nicht auf der Website, gehen Sie davon aus, dass sie Ihnen nicht gefallen wird.
  3. Bekommen Sie die Daten wieder heraus? Export in einem brauchbaren Format, auf Abruf, ohne den Support zu fragen.
  4. Hybride Suche und Reranking, oder schlichte Vektorsuche? Fragen Sie nach; es wird selten beworben.
  5. Was passiert an der Grenze des kostenlosen Tarifs? Gelöscht, eingefroren oder nur lesbar — drei sehr verschiedene Ausgänge.

Wo Pryzm steht

Pryzm Memory ist von der zweiten Sorte: ein gehosteter Endpunkt, OAuth-Anmeldung, geteilt von jedem Client, den Sie verbinden. Es läuft auf Servern in Deutschland unter EU-Rechtsordnung, verschlüsselt im Ruhezustand, mit einem Datenbankschema und einer Rolle pro Kunde, durchgesetzt von PostgreSQL selbst. Die Suche ist hybrid, mit einem mehrsprachigen Reranker, über acht Sprachen.

Es ist außerdem nicht Open Source, und Sie können es heute nicht selbst hosten — was für manche ein Ausschlusskriterium ist, und wir schreiben es lieber hier hin, als dass Sie es nach der Anmeldung entdecken. Wir pflegen einen ehrlichen Vergleich mit den Alternativen, einschließlich jener, die uns genau in diesen beiden Punkten schlagen.