ARTIKELSERIE · 5 TEILE
Das Gedächtnis der
KI-Agenten
Von stateless LLMs zu produktionsreifen Memory-Architekturen – und warum 140 Jahre Kognitionspsychologie erklären, wie Maschinen erinnern, halluzinieren und vergessen.
Worum geht’s
Ein LLM-Call ist ein Clean Slate. Kein State, kein Kontext, keine Erinnerung an gestern. Trotzdem bauen wir gerade Systeme, die über Tage mitarbeiten sollen – und zwischen dem Prompt-Input und den eingefrorenen Trainingsgewichten klafft eine Lücke, die Memory-Architekturen füllen müssen.
Seit 2023 ist daraus eine eigene Teildisziplin geworden. Mem0, Zep, Letta, Claude-Code-MEMORY.md, Sleep-Time Agents, In-Place Test-Time-Training – das Vokabular wächst schneller, als man nachlesen kann. Diese fünfteilige Serie sortiert die Landschaft, ordnet sie kognitionspsychologisch ein, misst sie mit Benchmarks, taucht tief in Generative Agents ein – und zeigt, wo Governance das nächste harte Problem wird.
Kein Hype, keine Tool-Cheerleader. Nur: Was existiert, warum es funktioniert, womit man es misst – und wer das Gedächtnis kontrolliert.
Memory is more about how agents manage context than the exact retrieval mechanism used.
Letta, Benchmarking AI Agent Memory, 2025
DIE SERIE
Fünf Perspektiven auf KI-Memory,
ein roter Faden
01
Architekturen
KI-Agenten mit Gedächtnis
Von Context Window über RAG bis MemGPT/Letta, Mem0 und Zep – die komplette Landschaft der Memory-Architekturen.
02
KOGNITIONSPSYCHOLOGIE
Halluzination ist kein Bug
140 Jahre Kognitionsforschung – von Bartletts Schemas über Atkinson-Shiffrin bis Tulving – und was das für Memory-Design bedeutet.
03
BENCHMARKS
Das vermessene KI-Gedächtnis
LoCoMo, DMR, LongMemEval, RULER – wie wir Memory-Systeme benchmarken. Plus: Warum ByteDance Memory zurück ins Modell holt.
04
DEEP DIVE
Generative Agents – Tulvings Modell in der Praxis
Wie Park et al. Tulvings komplette Taxonomie nachbauten – Memory Stream, Reflection, Planning und emergentes Sozialverhalten.
05
GOVERNANCE
Halluzination in der Erinnerung – Memory-Governance
DSGVO trifft Vektor-Store, OWASP listet Memory Poisoning, und die Frage, wer das Gedächtnis kontrolliert.
Unsere Expertise kommt nicht nur von unseren Kundenprojekten, sondern auch von eigenen Enterprise-Lösungen
140 Jahre Forschung
Die Kognitionspsychologie ist keine historische Kuriosität. Ihre wichtigsten Einsichten stecken heute in KI-Architekturen, die produktiv laufen.
Der AUFBAU
Fünf Layer
Memory lässt sich auf fünf Ebenen einordnen – von der Infrastruktur bis zur Kontrollfrage. Jeder Artikel der Serie deckt mindestens eine ab.
Tool-Layer
„Der Agent ruft sein Wissen aktiv ab.“
Hermes Session Search · Letta Filesystem · RAG
Produktiv
→ Teil I & II
Memory-Layer
„Externe Stores mit Konsolidierung.“
Mem0 · Zep · Letta Sleep-Time · Claude Memory
Produktiv
→ Teil I & II
Model-Layer
„Das Modell lernt während der Antwort.“
In-Place TTT · Titans · Fast Weights · SleepGate
Forschung, 2026
→ Teil III
Emergenz-Layer
„Aus Gedächtnis wird Sozialverhalten – ohne dass es jemand programmiert.“
Generative Agents · Memory Stream · Reflection · Planning
Forschung, 2023
→ Teil IV
Governance-Layer
„Wer kontrolliert das Gedächtnis – User, Developer oder Modell?“
DSGVO · OWASP ASI06 · Bi-Temporal Audit · A-MemGuard
Neues hartes Problem
→ Teil V
Fünf Ebenen, fünf Paradigmen. Von oben nach unten steigt die Abstraktion – und die Komplexität der offenen Fragen. Der Governance-Layer ist der jüngste und betrifft alle darüberliegenden.
LESEWEG
Aufeinander aufgebaut
Die Serie liest sich am besten in Reihenfolge – jeder Teil referenziert Konzepte der vorherigen. Einzeln funktionieren sie trotzdem.
Teil 1
Architekturen & Tools
Teil 2
Kognitionspsychologie
Teil 3
Benchmarks & Messung
Teil 4
Generative Agents
Teil 5
Governance & Recht
Memory-Architektur
Wir bauen KI-Agenten mit produktionsreifem Gedächtnis – von RAG über Multi-Agent-State bis Governance. Kein Pitch-Deck, nur Kaffee und Klartext.
