2026-07-31T21:44:52.193Z
Speichertypen von KI-Agenten: Führen Sie für jeden einen Gesundheitstest durch
Wählen Sie Arbeitsgedächtnis, semantisches Gedächtnis, episodisches Gedächtnis oder prozedurales Gedächtnis anhand seiner Grenzen aus und überprüfen Sie es dann mit einer inhaltsfreien, typspezifischen Quittung.
Die nützliche Antwort auf die Frage „Welchen Speichertyp für KI Agenten benötige ich?“ ist nicht „alle von ihnen“. Wählen Sie den kleinsten Speicher aus, der die für Ihre Aufgabe erforderliche Grenze überschreitet, und unterziehen Sie diesen Speicher dann einem eigenen Akzeptanztest. Ein aktuelles Ziel, das den nächsten Diagrammschritt überstehen muss, ist Arbeitsgedächtnis . Eine Tatsache, die sitzungsübergreifend verfügbar bleiben muss, ist das semantische Gedächtnis . Ein früherer Versuch, der aufgrund des Geschehens wertvoll ist, ist das episodische Gedächtnis . Eine Regel, die die Art und Weise verändert, wie zukünftige Arbeit ausgeführt wird, ist das prozedurale Gedächtnis . Diese vier Jobs scheitern unterschiedlich. Eine generische „Die Vektorsuche hat ein Ergebnis zurückgegeben“ Prüfung kann einen verlorenen Prüfpunkt, eine veraltete Tatsache, eine Episode ohne Ergebnis oder ein nicht genehmigtes Verfahren übersehen. Der betriebliche Standardwert ist daher: 1. deklarieren Sie die Grenze, die die Erinnerung überschreiten muss; 2. eine inhaltsfreie Schreib und Lesebestätigung behalten; 3. Umfang, Frische, Herkunft und Aktivierung überprüfen; 4. eine typspezifische Invariante anwenden; 5. Überprüfen Sie die externe Aufgabe separat. Dieser Artikel verwandelt die gängige Taxonomie KI Agent Speichertypen in diesen testbaren Vertrag. Beginnen Sie mit der Grenze, nicht mit der Datenbank Der CoALA Architektur trennt das kurzfristige Arbeitsgedächtnis vom episodischen, semantischen und prozeduralen Langzeitgedächtnis. Es unterscheidet auch das Abrufen, das das Langzeitgedächtnis in das Arbeitsgedächtnis einliest, vom Denken im Arbeitsgedächtnis und dem Lernen, das das Langzeitgedächtnis schreibt. Diese Trennung ist betrieblich sinnvoller als eine Liste von Speicherprodukten. Eine PostgreSQL Zeile, eine JSON Datei, ein Vektor und ein Prüfpunkt können jeweils mehr als einen Speichertyp implementieren. Der Datenspeicher sagt Ihnen nicht, welcher Fehler wichtig ist. LangGraphs Speicherdokumentation konkretisiert die Bereichsunterscheidung: Kurzfristige Zustände werden an einen Thread angehängt, während langfristige Elemente in benutzerdefinierten Namespaces leben und Threads übergreifen können. In derselben Dokumentation wird das semantische Gedächtnis als Fakten, das episodische Gedächtnis als Erfahrungen und das prozedurale Gedächtnis als Regeln oder Anweisungen beschrieben. Dies sind unterschiedliche Verträge, selbst wenn ein Geschäft alle drei Verträge hält. Verwenden Sie eine Frage, um die erste Grenze auszuwählen: Was muss noch vorhanden sein, in welchem Umfang, bei welcher zukünftigen Entscheidung? „Merken Sie sich das aktuelle Werkzeugergebnis während dieses Laufs“ erfordert einen kleineren Vertrag als „Merken Sie sich diese Kundenpräferenz nächsten Monat.“ „Einen ähnlichen Vorfall zurückrufen“ ist schwächer als „Nur das genehmigte Wiederherstellungsverfahren aktivieren“. Das Hinzufügen eines Langzeitgedächtnisses dort, wo der Arbeitszustand ausreichen würde, führt zu zusätzlichen Aufbewahrungs , Lösch , Datenschutz und Abrufpflichten. Der aktuelle Implementierungsleitfaden von Redis empfiehlt, mit dem kurz oder langfristigen Bedarf zu beginnen und spezialisierten Speicher hinzuzufügen, wenn sein betrieblicher Wert die Komplexität rechtfertigt. Das ist eine gute Standardeinstellung, unabhängig davon, ob Redis der ausgewählte Store ist. Führen Sie für jeden Speichertyp einen anderen Akzeptanztest durch Die vier Typen können sich einen Beweisumschlag teilen, aber sie sollten ihre endgültige Urteilsregel nicht teilen. Speichertyp Arbeit Zu beweisende Grenze Typspezifischer Fehler Arbeiten Tragen Sie aktive Ziele, Zwischenergebnisse und Abhängigkeiten bei Der nächste erforderliche Schritt, Prüfpunkt oder kontrollierte Neustart Das Element wurde geschrieben und gelesen, hat jedoch die erforderliche Kontinuitätsgrenze nicht überschritten Semantisch Liefern Sie aktuelle Fakten und Konzepte Der vorgesehene Mandanten , Benutzer , Projekt oder Agentenbereich über Sitzungen hinweg Der abgerufene Fakt ist veraltet, überholt oder stammt aus dem falschen Bereich Episodisch Eine vergangene Erfahrung wiederverwenden Von einem aufgezeichneten Versuch bis zu einer späteren Entscheidung, die ihr Ergebnis benötigt Der Episode fehlt ein beobachtetes Ergebnis, sodass der Agent den Erfolg nicht anhand der Aktivität erkennen kann Verfahrenstechnisch Kontrollieren Sie, wie die Arbeit ausgeführt wird Von einer genehmigten Version bis zur aktiven Eingabeaufforderung, Regel, Codepfad oder Modellverhalten Die aktive Prozedur ist nicht genehmigt, nicht versioniert oder verfügt über kein begrenztes Rollback Arbeitsgedächtnis: Kontinuität beweisen Arbeitsgedächtnis ist nicht gleichbedeutend mit „was auch immer in den Modellkontext passt“. CoALA beschreibt es als die aktiven Variablen, die für den aktuellen Entscheidungszyklus verfügbar sind. In einer Laufzeit kann dieser Status aus Nachrichten, einem Diagrammprüfpunkt, Aufgabenmetadaten, Toolergebnissen oder einem externen Statusdatensatz zusammengestellt werden. Testen Sie es mit einem undurchsichtigen Kanarienvogel, der an einer erforderlichen Grenze befestigt ist: Schreiben Sie die ID des aktiven Ziels und die Checkpoint Version. einen echten Schritt vorrücken oder den kontrollierten Neustart durchführen, den die Laufzeit zu überleben verspricht; Lesen Sie den Status im selben erwarteten Thread oder Ausführungsbereich. Bestätigen Sie, dass die Ziel ID und die ausstehende Abhängigkeit noch verfügbar sind. Beweisen Sie, dass der wiederhergestellte Wert in die nächste Entscheidung eingegangen ist. Der letzte Check zählt. Ein Prüfpunkt kann den Canary enthalten, während die Prompt Assembly ihn stillschweigend weglässt. Lagerung ist grün; Verhalten ist es nicht. Semantisches Gedächtnis: Aktualität und Umfang beweisen Das semantische Gedächtnis speichert Fakten und nicht ein bestimmtes Ereignis. Eine gesunde Lektüre braucht mehr als nur Ähnlichkeit. Behalten Sie die undurchsichtige Speicher ID, die Quellversion, den Bereichs Hash, die Schreibzeit, die Lesezeit und den Ungültigkeitsstatus bei. Überprüfen Sie dann, ob der effektive Fakt für die Entscheidungszeit aktuell ist und zum erwarteten Namespace gehört. Ein hoher Ähnlichkeitswert kann eine ersetzte Adresse oder eine widerrufene Berechtigung nicht aktuell machen. Die sichere Antwort auf widersprüchliche Fakten ist normalerweise unsicher und nicht „wähle den nächstgelegenen Vektor“. Klären Sie die Herkunft oder fragen Sie einen Menschen, bevor Sie zulassen, dass die Tatsache eine irreversible Handlung auslöst. Episodisches Gedächtnis: Beweisen Sie das Ergebnis Eine Episode ist nützlich, weil sie eine Situation, eine Aktion und das, was darauf folgte, miteinander verbindet. Ein Ereignisprotokoll, das viele Toolaufrufe enthält, ist nicht automatisch ein episodischer Speicher. Für einen Incident Response Agenten ist eine Episode wie „Export erneut versucht“ unvollständig. Der nützliche Datensatz gibt auch Auskunft darüber, ob das Ziel genau einen gültigen Export erhalten hat, ob der erneute Versuch sein Budget erschöpft hat und ob ein Mensch eingegriffen hat. Der inhaltsfreie Beleg kann eine Episoden ID, einen Aktionsklassen Hash, eine Ergebnis Beleg ID, Zeitstempel und einen Überprüfungsstatus enthalten. Testen Sie den Abruf mit einem bekannten Fall, dessen Ergebnis die richtige nächste Aktion ändert. Wenn die Episode zurückgegeben wird, aber das Ergebnis ausbleibt, klassifizieren Sie sie als OUTCOMELESS EPISODE . Lassen Sie nicht zu, dass Aktivität als Erfahrung maskiert wird. Prozedurales Gedächtnis: Autorität beweisen Das prozedurale Gedächtnis umfasst die Regeln, die zur Ausführung von Aufgaben verwendet werden. CoALA umfasst sowohl implizite Prozeduren in Modellgewichten als auch explizite Prozeduren im Agentencode; Der Leitfaden von LangGraph enthält in dieser Kategorie auch Code, Modellgewichte und Eingabeaufforderungen. Dies ist die Erinnerung mit dem höchsten Risiko, sich zu ändern, da sie zukünftiges Verhalten verändert. Die Quittung sollte Folgendes enthalten: die aktive Verfahrensversion; die genehmigte Version; der Akteur oder die Richtlinie, die die Werbung genehmigt hat; eine Testsuite oder eine Evaluierungsreferenz; eine Aktivierungszeit; eine Rollback Referenz; der Umfang, in dem das Verfahren ausgeführt werden darf. Wenn sich aktive und genehmigte Versionen unterscheiden, ist der Abrufzustand irrelevant. Das korrekte Urteil ist UNSAFE PROCEDURE , und der nächste Schritt ist eine Autoritäts oder Freigabeentscheidung – kein automatisches Umschreiben. Verwenden Sie eine inhaltsfreie Quittung Der gemeinsame Umschlag unten zeichnet betriebliche Beweise auf, ohne den Sachverhalt, die Episode, die Aufforderung oder den Benutzerinhalt zu speichern: Sieben Checks bilden den gemeinsamen Weg: 1. Verfügbar: War das Speichersubsystem beobachtbar oder ist das Urteil unbekannt? 2. Schreiben: Hat der vorgesehene Speicher den Schreibvorgang bestätigt? 3. Lesen Sie: Wurde bei einer späteren Entscheidung dasselbe undurchsichtige Element abgerufen? 4. Geltungsbereich: Stimmten erwartete und beobachtete Bereichskennungen überein? 5. Frische: Lag der Beweis innerhalb des angegebenen Altersbudgets? 6. Herkunft: Kann das System erkennen, woher dieser Artikel oder diese Version stammt? 7. Aktivierung: Hat das Element die beabsichtigte Entscheidung getroffen und ist es nicht nur in den Suchergebnissen aufgetaucht? Wenden Sie dann die typspezifische Regel an: Kontinuität für das Arbeitsgedächtnis, Quellwährung für das semantische Gedächtnis, Ergebnisverknüpfung für das episodische Gedächtnis oder Genehmigung und Rollback für das prozedurale Gedächtnis. Die Anordnung verhindert irreführende Urteile. Beispielsweise sollte eine Bereichsinkongruenz die Auswertung vor der Aktivierung stoppen. Ein fehlender Lesevorgang sollte nicht zu „nicht aktiviert“ werden, da die erste fehlgeschlagene Ebene der Abruf ist. Führen Sie den Neun Fall Klassifikator aus Das inspizierbare Veröffentlichungsartefakt enthält memory health cases.json und classify memory health.mjs . Die Entscheidungspriorität ist klein genug, um in jeder Laufzeit reproduziert zu werden: Der Bericht deckt einen Fall mit gesundem Arbeitsspeicher plus Kontinuitätsverlust, veralteten semantischen Daten, einer Bereichsverletzung, einer Episode ohne Ergebnis, einer abgerufenen, aber nicht aktivierten Episode, einem nicht genehmigten Verfahren, einem Abruffehler und nicht verfügbaren Beweisen ab. Laufen: Das aufgezeichnete Ergebnis für diesen Artikel war: Dieser Durchgang beweist, dass der Klassifikator seiner erklärten Priorität folgt. Es beweist nicht , dass ein Live Speicher Backend fehlerfrei ist. Trennen Sie die Gedächtnisgesundheit vom Aufgabenerfolg Eine Speicherbestätigung kann beweisen, dass ein undurchsichtiges Element seine deklarierte Grenze überschritten hat. Es kann nicht beweisen, dass eine Tatsache wahr ist, dass die erinnerte Episode der beste Präzedenzfall ist oder dass ein genehmigtes Verfahren in jeder Umgebung erfolgreich sein wird. Bewahren Sie nach Möglichkeit einen zweiten, deterministischen Ergebnisbeleg auf. Ein Supportmitarbeiter kann die aktuellen Versandpräferenzen eines Kunden korrekt abrufen und die Bestellung trotzdem nicht aktualisieren. Ein Codierungsagent kann nach dem Neustart das genaue aktive Ziel wiederherstellen und trotzdem die angeforderte Datei weglassen. Ein Wiederherstellungsagent kann das genehmigte Runbook aktivieren und dennoch einen doppelten externen Effekt erzeugen. Der Betriebszustand sollte beide Hauptbücher widerspiegeln: Speicher fehlerfrei, Ergebnis überprüft: Speicherproblem beheben; Speicher fehlerfrei, Ergebnis fehlt: Ausführung oder Zielüberprüfung untersuchen; Speicher fehlgeschlagen, Ergebnis überprüft: Eine verschlechterte Abhängigkeit aufzeichnen; der Lauf könnte durch einen Fallback erfolgreich gewesen sein; Speicher fehlgeschlagen, Ergebnis fehlt: Korrigieren Sie die erste fehlgeschlagene Speicherschicht, bevor Sie einem Wiederholungsversuch vertrauen; Beweise nicht verfügbar: Bleiben Sie unsicher, statt umweltfreundlich zu produzieren. Diese Trennung schränkt auch die Datenerhebung ein. Gesundheitsnachweise können Hashes, IDs, Versionen, Zeitstempel, Bereiche, Boolesche Werte und Urteile speichern. Kurztexte, persönliche Fakten, Episodeninhalte, Toolargumente und Geheimnisse müssen den Gastgeber nicht nur verlassen, um zu zeigen, dass ein Vertrag zustande gekommen ist. Wählen Sie den kleinsten Vertrag, der funktionieren kann Beginnen Sie bei einem neuen Agenten mit dem Ergebnis und arbeiten Sie rückwärts vor: 1. Wenn Informationen nur während des aktuellen Entscheidungszyklus benötigt werden, behalten Sie sie im Arbeitsgedächtnis. 2. Wenn ein Fakt sitzungsübergreifend sein muss, fügen Sie semantischen Speicher mit Quell , Umfangs , Aktualisierungs und Ungültigkeitsregeln hinzu. 3. Wenn ein früherer Versuch eine spätere Entscheidung beeinflussen sollte, fügen Sie das episodische Gedächtnis nur dann hinzu, wenn der Versuch eine Ergebnisbestätigung hat. 4. Wenn sich das Verhalten selbst ändern muss, behandeln Sie diese Änderung als prozedurales Gedächtnis und umgeben Sie sie durch Beförderung, Genehmigung, Tests und Rollback. Fügen Sie keinen Speichertyp hinzu, da ein Framework eine Klasse mit diesem Namen anbietet. Fügen Sie es hinzu, wenn eine beobachtbare Aufgabengrenze dies erfordert. Nennen Sie es nicht gesund, weil der Laden reagiert. Man kann es als gesund bezeichnen, wenn die richtigen Beweise geschrieben, im richtigen Umfang abgerufen, immer noch aktuell, bei der beabsichtigten Entscheidung aktiviert und die für diesen Typ spezifische Invariante übergeben wurden. Sidewisp befindet sich derzeit in einer privaten Vorschauphase. Das vorgesehene Zustandsmodell umfasst fehlende Lese oder Schreibvorgänge im Speicher, fehlgeschlagene Persistenz, veraltete Synchronisierung und verlorene Entscheidungen, aber die Erfassung des Zustands des Produktionsagenten und Laufzeitadapter werden derzeit nicht ausgeliefert. Bei der Quittung in diesem Artikel handelt es sich um ein Design, das Sie jetzt lokal ausführen können; Es besteht kein Anspruch darauf, dass Sidewisp Ihre Agenten derzeit überwacht oder repariert.