2026-07-31T22:34:52.444Z

AI tipi di memoria: date a ciascuno un test di salute

Scegliere la memoria di lavoro, semantica, episodica o procedurale per il suo limite, quindi verificarla con un ricevimento specifico per il tipo senza contenuti.

La risposta utile a quale tipo di memoria di agente AI ho bisogno? non è tutti. Scegli la memoria più piccola che attraversa il limite richiesto dal tuo compito, quindi date a quella memoria il suo test di accettazione. Un obiettivo attuale che deve sopravvivere al passo successivo del grafico è la memoria di lavoro . Un fatto che deve rimanere disponibile in tutte le sessioni è la memoria semantica . Un tentativo passato che è prezioso a causa di quello che è successo è la memoria episodic . Una regola che modifica il modo in cui viene eseguito il lavoro futuro è la memoria procedurale . Questi quattro lavori falliscono in modo diverso. Una verifica generica la ricerca vettoriale ha restituito un risultato può perdere un punto di controllo perso, un fatto obsoleto, un episodio senza risultato o una procedura non approvata. Il default operativo è pertanto: 1. dichiarare il confine che la memoria deve attraversare; 2. conservare una ricevuta di scrittura e lettura senza contenuti; 3. verificano la portata, la freschezza, la provenienza e l'attivazione; 4. applicare una invariante specifica per il tipo; 5. verificare separatamente il compito esterno. Questo articolo trasforma la tassonomia comune di AI tipi di memoria degli agenti in tale contratto verificabile. Inizia con il limite, non il database. La Architettura CoALA separa la memoria di lavoro a breve termine dalla memoria episodica, semantica e procedurale a lungo termine. Esso distingue anche il recupero, che legge la memoria a lungo termine nella memoria di lavoro, dal ragionamento all'interno della memoria di lavoro e dall'apprendimento che scrive la memoria a lungo termine. Tale separazione è operativamente più utile di un elenco di prodotti di stoccaggio. Una riga PostgreSQL, un file JSON, un vettore e un checkpoint possono implementare più di un tipo di memoria. Il datastore non ti dice quale sia il problema. Documentazione della memoria di LangGraph rende la distinzione di ambito concreta: uno stato a breve termine è attaccato a un filo, mentre gli elementi a lungo termine possono vivere in spazi di nome personalizzati e fili incrociati. La stessa documentazione descrive la memoria semantica come fatti, la memoria episodica come esperienze e la memoria procedurale come regole o istruzioni. Sono contratti diversi anche quando un negozio detiene tutti e tre. Usa una domanda per scegliere il primo confine: Cosa deve ancora essere disponibile, in che ambito, in quale decisione futura? Ricordare il risultato attuale dello strumento durante questa esecuzione ha bisogno di un contratto più piccolo di Ricordare questa preferenza del cliente il mese prossimo. Ricordare un incidente simile è più debole di attivare solo la procedura di recupero approvata. Aggiungere memoria a lungo termine dove lo stato di funzionamento sarebbe sufficiente crea ulteriori obblighi di conservazione, cancellazione, privacy e recupero. Guida attuale di attuazione di Redis raccomanda di iniziare con la necessità a breve termine versus a lungo termine e di aggiungere la memoria specializzata quando il suo valore operativo giustifica la complessità. E' un buon default, indipendentemente dal fatto che Redis sia il negozio scelto. Date a ciascun tipo di memoria un test di accettazione diverso I quattro tipi possono condividere una busta di prove, ma non dovrebbero condividere la loro regola finale del verdetto. Tipo di memoria Giobbe Limite da dimostrare Fallimento specifico per tipo Lavorare Portare obiettivi attivi, risultati intermedi e dipendenze Il passo successivo richiesto, il punto di controllo o il riavvio controllato L'articolo è stato scritto e letto, ma non ha superato il limite di continuità richiesto Semantica Fornire fatti e concetti attuali L'ambito di applicazione del tenente, dell'utente, del progetto o dell'agente previsto tra le sessioni Il fatto recuperato è obsoleto, sostituito, o fuori dal campo di applicazione sbagliato Episodico Riutilizzare un'esperienza passata Da un tentativo registrato a una decisione successiva che ha bisogno del suo risultato L'episodio non ha un risultato osservato, quindi l'agente non può distinguere il successo dall'attività Procedurale Controllare il modo di svolgere il lavoro Da una versione approvata al prompt attivo, regola, percorso di codice o comportamento modello La procedura attiva non è approvata, non è modificata o non presenta un rimpatrio limitato Memoria di lavoro: prova di continuità La memoria di lavoro non è sinonimo di qualunque cosa si adatti al contesto del modello. CoALA la descrive come le variabili attive disponibili per il ciclo decisionale corrente. In un runtime, tale stato può essere assemblato da messaggi, un checkpoint grafico, metadati di attività, risultati degli strumenti o un record esterno dello stato. Prova con un canario opaco legato al limite richiesto: scrivere l'ID dell'obiettivo attivo e la versione del punto di controllo; avanzare un passo reale o eseguire il riavvio controllato della promessa di sopravvivenza in tempo di esecuzione; leggere lo stato nello stesso filo o nell'ambito di applicazione atteso; confermare che l'ID di destinazione e la dipendenza in sospeso sono ancora disponibili; dimostrare il valore ripristinato inserito nella decisione successiva. L'ultimo assegno conta. Un posto di controllo può contenere il canario, mentre il pronto assemblaggio lo omette silenziosamente. Lo stoccaggio e' verde; il comportamento no. Memoria semantica: dimostrare valuta e portata La memoria semantica memorizza i fatti piuttosto che un evento particolare. Una lettura sana ha bisogno di più di similitudine. Conserva l'ID di memoria opaca, la versione sorgente, l'hash di ambito, il tempo di scrittura, il tempo di lettura e lo stato di invalidità. Verificare quindi che il fatto effettivo sia attuale per il tempo di decisione e appartenga allo spazio di nome previsto. Un punteggio di somiglianza elevato non può rendere corrente un indirizzo sostituito o un permesso revocato. La risposta sicura ai fatti contraddittori è di solito uncertain , non scegliere il vettore più vicino. Risolvere la provenienza o chiedere a un essere umano prima di permettere al fatto di guidare un'azione irreversibile. Memoria episodica: dimostra il risultato Un episodio è utile perché collega una situazione, un'azione e ciò che ne è seguito. Un registro di eventi contenente molte chiamate degli strumenti non è automaticamente memoria episodica. Per un agente di risposta agli incidenti, un episodio come retried the export è incompleto. L'utile registro indica anche se la destinazione ha ricevuto esattamente una esportazione valida, se il nuovo tentativo ha esaurito il suo bilancio e se un essere umano è intervenuto. La ricevuta senza contenuti può mantenere un ID dell'episodio, hash di classe di azione, ID di ricevuta dei risultati, timestamp e stato di verifica. Ritorno di prova con un caso conosciuto il cui risultato modifica la corretta successiva azione. Se l'episodio viene restituito ma il risultato è assente, classificalo come OUTCOMELESS EPISODE . Non permettere che l'attività si maschere come esperienza. Memoria procedurale: prova di autorità La memoria procedurale comprende le regole utilizzate per l'esecuzione dei compiti. CoALA include sia le procedure implicite nei pesi del modello che le procedure esplicite nel codice dell'agente; la guida di LangGraph comprende anche il codice, i pesi del modello e le istruzioni in questa categoria. Questa e' la memoria a piu' rischio da cambiare perche' altera il comportamento futuro. La ricevuta dovrebbe comprendere: la versione della procedura attiva; la versione approvata; l'attore o la politica che ha autorizzato la promozione; un documento di prova o di riferimento di valutazione; un tempo di attivazione; un riferimento di ritorno; il campo di applicazione in cui la procedura può essere eseguita. Se le versioni attive e quelle approvate differiscono, la salute del recupero è irrilevante. Il verdetto corretto è UNSAFE PROCEDURE , e la prossima mossa è una decisione di autorizzazione o rilascionon una riscrizione automatica. Utilizzare una ricevuta senza contenuti L'involucro condiviso di seguito registra le prove operative senza memorizzare i fatti, gli episodi, i consigli o i contenuti dell'utente: Sette controlli costituiscono il percorso comune: 1. Adisponibile: Il sottosistema di memoria era osservabile o il verdetto è sconosciuto? 2. Write: Il negozio previsto ha riconosciuto la scrittura? 3. Leggi: Una decisione successiva ha recuperato lo stesso elemento opaco? 4. Scope: I parametri di portata attesi e osservati corrispondono? 5. Freshness: La prova era all'interno del budget di età dichiarato? 6. Provenance: Può il sistema identificare da dove proviene questo articolo o questa versione? 7. AAtivazione: L'elemento è inserito nella decisione prevista, piuttosto che semplicemente apparire nei risultati della ricerca? Applicare quindi la regola specifica per il tipo: continuità per la memoria di lavoro, valuta sorgente per la memoria semantica, collegamento di risultato per la memoria episodica o approvazione e rollback per la memoria procedurale. L'ordine impedisce di ottenere verdetti fuorvianti. Ad esempio, una discrepanza di ambito dovrebbe interrompere la valutazione prima dell'attivazione. Una lettura mancante non deve diventare non attivata, perché il primo strato fallito è il recupero. Eseguire il classificatore di nove casi L'artefatto di pubblicazione ispezionabile contiene memory health cases.json e classify memory health.mjs . La priorità decisionale è sufficientemente piccola da riprodursi in qualsiasi periodo di esecuzione: Il dispositivo comprende un caso di memoria di lavoro sano più perdita di continuità, dati semantici obsoleti, una violazione del campo di applicazione, un episodio senza risultato, un episodio recuperato ma non attivato, una procedura non approvata, un fallimento del recupero e prove non disponibili. Correre: Il risultato registrato per questo articolo è stato: Tale passaggio dimostra che il classificatore segue la sua priorità dichiarata. Znot dimostra che un backend di memoria live è sano. Separare la salute della memoria dal successo delle attività Una ricevuta di memoria può dimostrare che un oggetto opaco ha superato il suo limite dichiarato. Non può dimostrare che un fatto sia vero, che l'episodio richiamato sia il migliore precedente, o che una procedura approvata avrà successo in ogni ambiente. Tenere un secondo ricevimento deterministico di risultato quando possibile. Un agente di supporto può recuperare correttamente le preferenze di spedizione attuali del cliente e non aggiornare l'ordine. Un agente di codifica può ripristinare l'obiettivo attivo esatto dopo il riavvio e omettere comunque il file richiesto. Un agente di recupero può attivare la scheda di esecuzione approvata e comunque produrre un duplicato effetto esterno. Lo stato operativo dovrebbe riflettere entrambi i registri: memoria sana, risultato verificato: eliminare il problema relativo alla memoria; memoria sana, risultato mancante: indagare sull'esecuzione o sulla verifica della destinazione; memoria fallita, risultato verificato: registra una dipendenza degradata; la corsa può essere stata un successo per fallback; memoria fallita, risultato mancante: risolvere il primo livello di memoria fallito prima di fidarsi di un nuovo tentativo; prove non disponibili: Rimanere in incertezza piuttosto che produrre il verde. Questa separazione limita anche la raccolta dei dati. Le prove di salute possono conservare hash, ID, versioni, timestamp, scopes, booleans e verdetti. Il testo rapido, i fatti personali, il contenuto dell'episodio, gli argomenti degli strumenti e i segreti non devono lasciare l'host solo per dimostrare che un contratto è stato approvato. Scegli il contratto più piccolo che possa funzionare Per un nuovo agente, inizia con il risultato e lavora indietro: 1. Se le informazioni sono necessarie solo durante il ciclo decisionale corrente, conservatele nella memoria di lavoro. 2. Se un fatto deve intersezionare le sessioni, aggiungere la memoria semantica con le regole di sorgente, ambito, aggiornamento e invalidità. 3. Se un tentativo passato dovrebbe influenzare una scelta successiva, aggiungere la memoria episodica solo quando il tentativo ha un ricevimento di risultato. 4. Se il comportamento stesso deve cambiare, trattare quel cambiamento come memoria procedurale e mettere promozione, approvazione, test e rollback intorno a esso. Non aggiungere un tipo di memoria perché un framework offre una classe con quel nome. Aggiungilo quando un limite di attività osservabile lo richiede. Non chiamarlo sano perché il negozio risponde. Chiamarlo sano quando le prove corrette sono state scritte, richiamate nella giusta portata, ancora attuali, attivate alla decisione prevista e trasmesse l'invariante specifico per quel tipo. Sidewisp è attualmente in anteprima privata. Il suo modello di salute previsto include le letture o le scritture mancanti della memoria, la persistenza fallita, la sincronizzazione obsoleta e le decisioni perse, ma oggi non vengono spediti gli adattatori di raccolta e di gestione della salute degli agenti di produzione. La ricevuta di questo articolo è un disegno che puoi eseguire localmente ora; non è una affermazione che Sidewisp attualmente monitorino o riparino i tuoi agenti.