Un LLM no recuerda nada por sí mismo: cerrada la llamada, olvida (ver ventana de contexto). La memoria de un agente es todo lo que el harness hace para dar continuidad pese a esa amnesia.
1. Memoria de trabajo (dentro de la sesión). Es el historial que cabe en la ventana de contexto durante la tarea actual. El harness la gestiona con context engineering: resume lo viejo, mantiene lo relevante, descarta ruido.
2. Memoria persistente (entre sesiones). Información que sobrevive al cierre y se reinyecta en sesiones futuras:
CLAUDE.md: notas
de proyecto que se cargan siempre.Se solapan pero no son lo mismo:
En la práctica, la memoria persistente suele implementarse con las mismas piezas que el RAG (embeddings + búsqueda), pero el propósito es distinto.
Se apoya en context engineering y
RAG; una implementación concreta es
CLAUDE.md.