2026-07-31T21:44:52.385Z

Tipos de memoria de agentes de IA: realice una prueba de salud a cada uno

Elija memoria de trabajo, semántica, episódica o procedimental según sus límites, luego verifíquela con un recibo específico de tipo sin contenido.

La útil respuesta a "¿qué tipo de memoria de agente de IA necesito?" no es "todos ellos". Elija la memoria más pequeña que cruce el límite que requiere su tarea y luego dele a esa memoria su propia prueba de aceptación. Un objetivo actual que debe sobrevivir al siguiente paso del gráfico es la memoria de trabajo . Un hecho que debe permanecer disponible entre sesiones es la memoria semántica . Un intento pasado que es valioso por lo sucedido es la memoria episódica . Una regla que cambia la forma en que se realiza el trabajo futuro es la memoria de procedimiento . Esos cuatro trabajos fracasan de manera diferente. Una verificación genérica de "la búsqueda vectorial arrojó un resultado" puede pasar por alto un punto de control perdido, un hecho obsoleto, un episodio sin resultado o un procedimiento no aprobado. Por lo tanto, el valor operativo predeterminado es: 1. declarar el límite que la memoria debe cruzar; 2. conservar un recibo de escritura y lectura sin contenido; 3. verificar alcance, frescura, procedencia y activación; 4. aplicar una invariante específica de tipo; 5. Verifique la tarea externa por separado. Este artículo convierte la taxonomía común de tipos de memoria de agentes de IA en ese contrato comprobable. Comience con el límite, no con la base de datos El Arquitectura CoALA Separa la memoria de trabajo a corto plazo de la memoria episódica, semántica y procedimental a largo plazo. También distingue la recuperación, que lee la memoria a largo plazo en la memoria de trabajo, del razonamiento dentro de la memoria de trabajo y el aprendizaje que escribe la memoria a largo plazo. Esa separación es más útil desde el punto de vista operativo que una lista de productos de almacenamiento. Una fila de PostgreSQL, un archivo JSON, un vector y un punto de control pueden implementar más de un tipo de memoria. El almacén de datos no le dice qué falla importa. Documentación de la memoria de LangGraph hace que la distinción del alcance sea concreta: el estado a corto plazo está adjunto a un subproceso, mientras que los elementos a largo plazo pueden vivir en espacios de nombres personalizados y subprocesos cruzados. La misma documentación describe la memoria semántica como hechos, la memoria episódica como experiencias y la memoria procedimental como reglas o instrucciones. Estos son contratos diferentes incluso cuando una tienda tiene los tres. Utilice una pregunta para elegir el primer límite: ¿Qué debe quedar todavía disponible, en qué ámbito y en qué decisión futura? "Recordar el resultado de la herramienta actual durante esta ejecución" necesita un contrato más pequeño que "recordar esta preferencia del cliente el próximo mes". "Recordar un incidente similar" es más débil que "activar sólo el procedimiento de recuperación aprobado". Agregar memoria a largo plazo donde el estado de funcionamiento sería suficiente crea obligaciones adicionales de retención, eliminación, privacidad y recuperación. Guía de implementación actual de Redis recomienda comenzar con la necesidad a corto o largo plazo y agregar memoria especializada cuando su valor operativo justifique la complejidad. Este es un buen valor predeterminado, independientemente de si Redis es la tienda elegida. Dale a cada tipo de memoria una prueba de aceptación diferente Los cuatro tipos pueden compartir un sobre de evidencia, pero no deberían compartir su regla de veredicto final. Tipo de memoria Trabajo Límite para demostrar Fallo específico del tipo Laboral Llevar metas activas, resultados intermedios y dependencias. El siguiente paso requerido, punto de control o reinicio controlado El elemento fue escrito y leído, pero no cruzó el límite de continuidad requerido. Semántico Proporcionar hechos y conceptos actuales. El alcance del inquilino, usuario, proyecto o agente previsto en todas las sesiones El hecho recuperado está obsoleto, reemplazado o tiene un alcance incorrecto Episódico Reutilizar una experiencia pasada De un intento registrado a una decisión posterior que necesita su resultado El episodio carece de un resultado observado, por lo que el agente no puede distinguir el éxito de la actividad. Procesal Controlar cómo se realiza el trabajo. Desde una versión aprobada hasta el mensaje, la regla, la ruta del código o el comportamiento del modelo activo El procedimiento activo no está aprobado, no está versionado o no tiene una reversión limitada Memoria de trabajo: demostrar la continuidad La memoria de trabajo no es sinónimo de "lo que encaje en el contexto del modelo". CoALA lo describe como las variables activas disponibles para el ciclo de decisión actual. En tiempo de ejecución, ese estado puede ensamblarse a partir de mensajes, un punto de control gráfico, metadatos de tareas, resultados de herramientas o un registro de estado externo. Pruébelo con un canario opaco atado a un límite requerido: escriba el ID del objetivo activo y la versión del punto de control; avance un paso real o realice el reinicio controlado, el tiempo de ejecución promete sobrevivir; leer el estado en el mismo hilo esperado o ejecutar el alcance; confirme que el ID del objetivo y la dependencia pendiente aún estén disponibles; probar el valor restaurado entró en la siguiente decisión. El último control importa. Un punto de control puede contener el canario mientras que el ensamblaje rápido lo omite silenciosamente. El almacenamiento es verde; el comportamiento no lo es. Memoria semántica: demostrar vigencia y alcance La memoria semántica almacena hechos en lugar de un evento en particular. Una lectura saludable necesita más que similitudes. Conserve el ID de la memoria opaca, la versión de origen, el hash de alcance, el tiempo de escritura, el tiempo de lectura y el estado de invalidación. Luego verifique que el hecho efectivo esté actualizado para el momento de la decisión y pertenezca al espacio de nombres esperado. Una puntuación de similitud alta no puede hacer que una dirección reemplazada o un permiso revocado sea actual. La respuesta segura a hechos contradictorios suele ser incierta , no “elegir el vector más cercano”. Resuelva la procedencia o pregunte a un ser humano antes de permitir que el hecho impulse una acción irreversible. Memoria episódica: probar el resultado Un episodio es útil porque conecta una situación, una acción y lo que siguió. Un registro de eventos que contiene muchas llamadas a herramientas no es automáticamente memoria episódica. Para un agente de respuesta a incidentes, un episodio como “reintentar la exportación” está incompleto. El registro útil también indica si el destino recibió exactamente una exportación válida, si el reintento agotó su presupuesto y si intervino un humano. El recibo sin contenido puede conservar un ID de episodio, un hash de clase de acción, un ID de recibo de resultado, marcas de tiempo y un estado de verificación. Pruebe la recuperación con un caso conocido cuyo resultado cambia la siguiente acción correcta. Si se devuelve el episodio pero no hay resultado, clasifíquelo como OUTCOMELESS EPISODE . No permita que la actividad se haga pasar por experiencia. Memoria procesal: acreditar la autoridad La memoria procedimental incluye las reglas utilizadas para realizar tareas. CoALA incluye tanto procedimientos implícitos en los pesos del modelo como procedimientos explícitos en el código del agente; La guía de LangGraph también incluye código, pesos de modelos e indicaciones en esta categoría. Este es el recuerdo con mayor riesgo de cambiar porque altera el comportamiento futuro. Su recibo debe incluir: la versión del procedimiento activo; la versión aprobada; el actor o política que autorizó la promoción; un conjunto de pruebas o referencia de evaluación; un tiempo de activación; una referencia de reversión; el ámbito en el que podrá desarrollarse el procedimiento. Si las versiones activa y aprobada difieren, el estado de la recuperación es irrelevante. El veredicto correcto es UNSAFE PROCEDURE , y el siguiente paso es una decisión de autoridad o liberación, no una reescritura automática. Utilice un recibo sin contenido El sobre compartido a continuación registra evidencia operativa sin almacenar el hecho, episodio, aviso o contenido del usuario: Siete controles forman el camino común: 1. Disponible: ¿Se pudo observar el subsistema de memoria o se desconoce el veredicto? 2. Escribir: ¿La tienda prevista reconoció la escritura? 3. Leer: ¿Una decisión posterior recuperó el mismo elemento opaco? 4. Alcance: ¿Coincidieron los identificadores de alcance esperados y observados? 5. Frescura: ¿La evidencia estuvo dentro del presupuesto de edad declarado? 6. Procedencia: ¿Puede el sistema identificar de dónde proviene este artículo o versión? 7. Activación: ¿El artículo ingresó a la decisión deseada, en lugar de simplemente aparecer en los resultados de búsqueda? Luego aplique la regla específica del tipo: continuidad para la memoria de trabajo, moneda de origen para la memoria semántica, vinculación de resultados para la memoria episódica o aprobación y reversión para la memoria procedimental. La orden impide veredictos engañosos. Por ejemplo, una discrepancia en el alcance debería detener la evaluación antes de la activación. Una lectura faltante no debe quedar "no activada", porque la primera capa fallida es la recuperación. Ejecute el clasificador de nueve casos. El artefacto de publicación inspeccionable contiene memory health cases.json y classify memory health.mjs . La precedencia de decisión es lo suficientemente pequeña como para reproducirse en cualquier tiempo de ejecución: El accesorio cubre un caso de memoria de trabajo saludable más continuidad perdida, datos semánticos obsoletos, una violación del alcance, un episodio sin resultado, un episodio recuperado pero no activado, un procedimiento no aprobado, una falla de recuperación y evidencia no disponible. Correr: El resultado registrado para este artículo fue: Ese pase prueba que el clasificador sigue su precedencia declarada. No prueba que un backend de memoria viva esté en buen estado. Separe la salud de la memoria del éxito de la tarea Un recibo de memoria puede probar que un elemento opaco cruzó su límite declarado. No puede probar que un hecho sea cierto, que el episodio recordado sea el mejor precedente o que un procedimiento aprobado tenga éxito en todos los entornos. Mantenga un segundo recibo de resultado determinista siempre que sea posible. Un agente de soporte puede recuperar correctamente la preferencia de envío actual de un cliente y aún así no actualizar el pedido. Un agente de codificación puede restaurar el objetivo activo exacto después del reinicio y aun así omitir el archivo solicitado. Un agente de recuperación puede activar el runbook aprobado y aun así producir un efecto externo duplicado. El estado operativo debe reflejar ambos libros de contabilidad: memoria sana, resultado verificado: solucione el problema relacionado con la memoria; memoria en buen estado, falta resultado: investigar la ejecución o la verificación del destino; fallo de memoria, resultado verificado: registra una dependencia degradada; la ejecución puede haber tenido éxito por vía alternativa; error en la memoria, falta el resultado: corrija la primera capa de memoria fallida antes de confiar en un reintento; evidencia no disponible: manténgase incierto en lugar de fabricar de forma ecológica. Esta separación también limita la recopilación de datos. La evidencia de salud puede conservar hashes, ID, versiones, marcas de tiempo, alcances, valores booleanos y veredictos. No es necesario que los mensajes de texto, los datos personales, el contenido del episodio, los argumentos de las herramientas y los secretos salgan del anfitrión simplemente para demostrar que se aprobó un contrato. Elija el contrato más pequeño que pueda funcionar Para un agente nuevo, comience con el resultado y avance hacia atrás: 1. Si la información se necesita sólo durante el ciclo de decisión actual, manténgala en la memoria de trabajo. 2. Si un hecho debe cruzar sesiones, agregue memoria semántica con reglas de origen, alcance, actualización e invalidación. 3. Si un intento pasado influye en una elección posterior, agregue la memoria episódica sólo cuando el intento tenga un resultado. 4. Si el comportamiento en sí debe cambiar, trate ese cambio como una memoria de procedimiento y colóquelo en promoción, aprobación, pruebas y retroceso. No agregue un tipo de memoria porque un marco ofrece una clase con ese nombre. Agréguelo cuando un límite de tarea observable lo requiera. No lo llames saludable porque la tienda responde. Llámelo saludable cuando se escribió la evidencia correcta, se recuperó en el alcance correcto, aún está vigente, se activó en la decisión prevista y se pasó la invariante específica de ese tipo. Sidewisp se encuentra actualmente en versión preliminar privada. Su modelo de estado previsto incluye lecturas o escrituras de memoria faltantes, persistencia fallida, sincronización obsoleta y decisiones perdidas, pero la recopilación de estado del agente de producción y los adaptadores de tiempo de ejecución no se envían hoy. El recibo de este artículo es un diseño que puede ejecutar localmente ahora; no es una afirmación de que Sidewisp actualmente monitoree o repare sus agentes.