Capítulo 3

Memoria y conocimiento

Los agentes recuerdan de cuatro formas distintas, y no son intercambiables. Saber en cuál poner algo es la mayor parte de la habilidad.

Todos los capítulos

Las cuatro capas

CapaContieneSe lee cuando
Memoria de la conversaciónTodo lo dicho en esta conversaciónEn cada turno de esa conversación
Memoria a largo plazoDatos y preferencias duraderos sobre ti y el trabajoEn cada turno de cada conversación
Base de conocimientoTus documentos subidos y páginas web guardadasSolo cuando el agente busca algo
HabilidadesProcedimientos: cómo hacer una tarea recurrenteCuando la tarea en cuestión coincide con una skill

Las dos primeras siempre están en juego y por tanto cuestan algo en cada turno; las dos segundas se consultan cuando hace falta y no cuestan nada hasta que se usan. Esa diferencia es la razón entera para ser deliberado sobre dónde vive cada cosa.

Memoria de la conversación

Cada conversación es un hilo duradero. Cierra el navegador, vuelve la semana que viene, ábrela de nuevo desde el riel de Chat: el agente sigue teniendo el contexto. Las conversaciones se listan de la más reciente a la más antigua, con una etiqueta legible, el canal del que vinieron, su número de mensajes y su coste acumulado.

Una conversación larga no se desploma: al acercarse al límite del modelo, los turnos más antiguos se compactan en el sitio para que el hilo siga adelante en vez de bifurcarse. La barra de contexto en la cabecera del chat muestra lo llena que está la conversación en este momento, y el comando /context abre una tarjeta de desglose - cuánto espacio ocupan el prompt de sistema, las herramientas, los archivos de memoria, las skills y los mensajes, cada uno por separado, y cuánto espacio libre queda.

Aquí importan dos comandos. /new empieza una conversación nueva, el movimiento correcto siempre que cambias de tema - un hilo limpio es más barato y más preciso que uno largo que arrastra un historial sin relación. /compact pide una compactación ahora en vez de esperar al límite.

Memoria a largo plazo

La Memoria sección es una vista directa del documento de memoria a largo plazo del agente, que se inyecta en sus instrucciones en cada turno. Hay tres modos de lectura disponibles: Esquema (secciones y datos, filtrables y plegables), Leer (renderizado) y Sin formato (el código fuente en markdown). Copiar y Descargar hacen lo que dicen.

Puedes escribir en ella de dos formas. El formulario de añadir rápido agrega un único dato: eliges una sección y aterriza en la memoria a largo plazo; dejas la sección en blanco y va en cambio al registro diario de hoy. El botón Editar abre el documento entero para editarlo - Guardar sobrescribe el archivo en una sola escritura atómica.

El agente también mantiene esto por sí mismo. Un bucle en segundo plano destila las conversaciones recientes en un registro diario fechado, y periódicamente pliega las partes duraderas de esos registros en el documento de memoria principal. Por eso la memoria crece sola, sin que nadie escriba en ella.

Atención

El editor de documento completo sustituye el archivo por entero. Las actualizaciones en vivo se pausan mientras editas, y si el agente cambia el archivo por debajo de ti, un aviso advierte de que guardar sobrescribirá la versión más reciente y ofrece recargar en su lugar. Lee ese aviso antes de guardar.

Mantén breve la memoria a largo plazo. Se lee en cada turno, así que debe contener cosas estables - quiénes son los clientes, cuál es el estilo de la casa, qué proveedor se prefiere - no una transcripción del martes pasado.

Tu base de conocimiento

La Conocimiento sección construye una colección buscable a partir de documentos y páginas web que aportas. Añade archivos individuales, añade URL, crea almacenes con nombre para que distintos cuerpos de material se mantengan separados, sincroniza un directorio entero, lista lo que se ha indexado, y elimina las fuentes que ya no quieras. La búsqueda se ejecuta en la base de conocimiento, el espacio de trabajo del agente, su memoria, o un almacén personalizado.

Aquí es donde van los manuales de producto, las listas de precios, las políticas, las propuestas pasadas y los PDF de referencia. El agente no lleva nada de esto en la cabeza; busca cuando una pregunta lo requiere y cita lo que encuentra. Eso mantiene las respuestas ancladas en tu material en vez de en el entrenamiento general del modelo, y mantiene en cero el coste de conservar un corpus grande hasta que de verdad se necesite.

Los archivos subidos mediante el compositor del chat aterrizan en el espacio de trabajo del agente y son visibles en la Archivos sección, dentro de uploads/ visibles. Cualquier cosa que el agente produce - una imagen generada, un informe, una captura de pantalla - aterriza allí también, lo que hace de Archivos el lugar donde mirar cuando quieres el artefacto en sí y no la conversación sobre él.

Nota

La indexación se ejecuta en segundo plano y se limita deliberadamente para que nunca ralentice una conversación en vivo. Una subida grande es buscable poco después de terminar, no al instante.

Notas

La Notas sección es un wiki en markdown enlazado que el agente lee y escribe. Cada nota tiene un título, etiquetas, alias y fuentes, y las notas se enlazan entre sí; el panel de lectura muestra ambas direcciones de ese grafo de enlaces como Enlaza a y Referenciada por -chips, para que puedas recorrer el vecindario de una idea. Un cuadro de búsqueda ejecuta una búsqueda por palabras clave en toda la colección.

Vale la pena conocer un indicador: auto-inject. Una nota marcada como auto-inject tiene su fragmento empujado al contexto del agente en cada turno, como la memoria a largo plazo - útil para una instrucción permanente que merece su propio documento, y limitado a las cinco notas más recientes de ese tipo para que no se hinche en silencio. Todo lo demás se consulta cuando hace falta.

Habilidades

Una skill es un procedimiento enseñado: una carpeta con instrucciones escritas y, opcionalmente, scripts para ejecutar. Donde el prompt de sistema dice quién es el agente, una skill dice cómo se hace un trabajo concreto - los pasos, el formato, las comprobaciones. El agente recoge la que corresponda cuando la tarea coincide, y las activas o desactivas por agente desde la pestaña Habilidades de la página de detalle del agente.

Las skills vienen de tres sitios: las que trae la plataforma, las escritas para tu despliegue, y las que el agente aprende por sí mismo mediante Cortex (ver capítulo 7). Escribe /skills en el chat para listar lo que el agente actual realmente tiene, agrupado por categoría. Si la auditoría de seguridad ha retenido una skill, también aparece ahí con el motivo, en vez de desaparecer en silencio.

Las skills son el sitio correcto para cualquier cosa con pasos. «Redactar la actualización semanal para el cliente sacando las tareas de la semana pasada, agrupándolas por cuenta y siguiendo esta plantilla» es una skill; intentar codificarlo como un párrafo del prompt de sistema empeora el prompt en todo lo demás.

¿Dónde debería ir esto?

  • Un dato que debería moldear cada respuesta - nuestro horario de oficina, el nombre del CEO, el tono que usamos - va en la memoria a largo plazo.
  • Un documento sobre el que alguien podría preguntar - la política de 40 páginas, el catálogo, el informe del año pasado - va en la base de conocimiento.
  • Un método repetible - cómo calificamos un lead, cómo damos formato al resumen - va en una skill.
  • Algo relevante solo para este hilo - dilo sin más en la conversación. Se recuerda mientras esa conversación exista.

El error común es volcar documentos en la memoria a largo plazo. Funciona durante una semana, y luego cada respuesta se vuelve más lenta, más cara y más confusa, porque el agente carga un archivador entero en cada conversación. Pon los documentos donde van los documentos.