Chapitre 3

Mémoire et connaissances

Les agents se souviennent de quatre façons différentes, et elles ne sont pas interchangeables. Savoir dans laquelle placer une chose est l'essentiel du savoir-faire.

Tous les chapitres

Les quatre couches

CoucheContientLu quand
Mémoire de conversationTout ce qui a été dit dans cette conversationÀ chaque tour de cette conversation
Mémoire longueFaits durables et préférences vous concernant, vous et le travailÀ chaque tour de chaque conversation
Base de connaissancesVos documents téléversés et pages web enregistréesSeulement quand l'agent cherche quelque chose
CompétencesProcédures - comment effectuer une tâche récurrenteQuand la tâche en cours correspond à un skill

Les deux premières sont toujours en jeu et coûtent donc quelque chose à chaque tour ; les deux secondes sont consultées à la demande et ne coûtent rien tant qu'elles ne servent pas. Cette différence est la seule raison d'être délibéré sur l'endroit où vivent les choses.

Mémoire de conversation

Chaque conversation est un fil durable. Fermez le navigateur, revenez la semaine prochaine, rouvrez-la depuis le rail Chat - l'agent garde toujours le contexte. Les conversations sont listées de la plus récente à la plus ancienne, avec un intitulé lisible, le canal d'origine, leur nombre de messages et leur coût cumulé.

Une longue conversation ne s'effondre pas : à l'approche de la limite du modèle, les tours les plus anciens sont compactés sur place pour que le fil continue au lieu de se scinder. La barre de contexte dans l'en-tête du chat indique à quel point la conversation est actuellement remplie, et la commande /context ouvre une carte de répartition - combien de place occupent respectivement le prompt système, les outils, les fichiers de mémoire, les skills et les messages, et combien d'espace libre il reste.

Deux commandes comptent ici. /new démarre une conversation neuve, ce qui est le bon réflexe dès que vous changez de sujet - un fil propre est moins coûteux et plus net qu'un long fil traînant un historique sans rapport. /compact demande une compaction immédiate plutôt que d'attendre la limite.

Mémoire longue

La Mémoire section est une vue directe du document de mémoire longue de l'agent, injecté dans ses instructions à chaque tour. Trois modes de lecture sont proposés : Plan (sections et faits, filtrables et repliables), Lire (rendu) et Brut (la source markdown). Copier et Télécharger font ce qu'ils indiquent.

Vous pouvez y écrire de deux façons. Le formulaire d'ajout rapide ajoute un seul fait : choisissez une section et il atterrit dans la mémoire longue ; laissez la section vide et il part plutôt dans le journal du jour. Le bouton Modifier ouvre le document entier pour le modifier - Enregistrer écrase le fichier en une seule écriture atomique.

L'agent entretient aussi cela lui-même. Une boucle en arrière-plan distille les conversations récentes en un journal quotidien daté, et replie périodiquement les parties durables de ces journaux dans le document de mémoire principal. C'est pourquoi la mémoire grandit d'elle-même, sans que personne n'y tape quoi que ce soit.

Attention

L'éditeur de document complet remplace le fichier en bloc. Les mises à jour en direct se mettent en pause pendant que vous modifiez, et si l'agent change le fichier sous vos pieds, une bannière avertit qu'enregistrer écrasera la version plus récente et propose de recharger à la place. Lisez cette bannière avant d'enregistrer.

Gardez la mémoire longue courte. Elle est lue à chaque tour, elle doit donc contenir des choses stables - qui sont les clients, quel est le style maison, quel fournisseur est préféré - pas une transcription de mardi dernier.

Votre base de connaissances

La Connaissances section constitue une collection consultable à partir des documents et pages web que vous fournissez. Ajoutez des fichiers individuels, ajoutez des URL, créez des entrepôts nommés pour que différents corpus restent séparés, synchronisez un répertoire entier, listez ce qui a été indexé, et retirez les sources dont vous ne voulez plus. La recherche s'exécute sur la base de connaissances, l'espace de travail de l'agent, sa mémoire, ou un entrepôt personnalisé.

C'est ici que vont les manuels produits, les grilles tarifaires, les politiques, les anciennes propositions et les PDF de référence. L'agent ne porte rien de tout cela en tête ; il cherche quand une question l'exige et cite ce qu'il trouve. Cela ancre les réponses dans votre matériel plutôt que dans l'entraînement général du modèle, et cela maintient à zéro le coût de conserver un large corpus tant qu'il n'est pas réellement nécessaire.

Les fichiers téléversés via le compositeur de chat atterrissent dans l'espace de travail de l'agent et sont visibles dans la Fichiers section, sous uploads/ visibles. Tout ce que l'agent produit - une image générée, un rapport, une capture d'écran - y atterrit aussi, ce qui fait de Fichiers l'endroit où chercher quand vous voulez l'artefact lui-même plutôt que la conversation qui en parle.

Remarque

L'indexation s'exécute en arrière-plan et est volontairement bridée pour ne jamais ralentir une conversation en direct. Un gros téléversement devient consultable peu après la fin, pas instantanément.

Notes

La Notes section est un wiki markdown lié que l'agent lit et écrit. Chaque note a un titre, des étiquettes, des alias et des sources, et les notes se relient entre elles ; le panneau de lecture affiche les deux sens de ce graphe de liens sous forme de Renvoie vers et Référencée par , pour que vous puissiez explorer le voisinage d'une idée. Une zone de recherche exécute une recherche par mot-clé sur toute la collection.

Un indicateur mérite d'être connu : auto-inject. Une note marquée auto-inject voit son extrait poussé dans le contexte de l'agent à chaque tour, comme la mémoire longue - utile pour une consigne permanente qui mérite son propre document, et limité aux cinq notes les plus récentes de ce type afin qu'il ne gonfle pas discrètement. Tout le reste est consulté à la demande.

Compétences

Un skill est une procédure apprise : un dossier contenant des instructions écrites et, en option, des scripts à exécuter. Là où le prompt système dit qui est l'agent, un skill dit comment un travail précis se fait - les étapes, le format, les vérifications. L'agent reprend celui qui convient quand la tâche correspond, et vous les activez ou désactivez par agent depuis l'onglet Compétences de la page de détail de l'agent.

Les skills proviennent de trois sources : ceux fournis avec la plateforme, ceux écrits pour votre déploiement, et ceux que l'agent apprend lui-même via Cortex (voir chapitre 7). Tapez /skills dans le chat pour lister ce que l'agent actuel possède réellement, regroupé par catégorie. Si un skill a été retenu par l'audit de sécurité, il apparaît là aussi avec la raison, plutôt que de disparaître silencieusement.

Les skills sont l'endroit approprié pour tout ce qui comporte des étapes. « Rédiger la mise à jour hebdomadaire client en reprenant les tâches de la semaine dernière, en les regroupant par compte, et en suivant ce modèle » est un skill ; essayer de l'encoder comme un paragraphe du prompt système rend le prompt moins bon pour tout le reste.

Où cela doit-il aller ?

  • Un fait qui doit façonner chaque réponse - nos horaires de bureau, le nom du PDG, le ton que nous employons - va dans la mémoire longue.
  • Un document sur lequel quelqu'un pourrait poser une question - la politique de 40 pages, le catalogue, le rapport de l'an dernier - va dans la base de connaissances.
  • Une méthode reproductible - comment on qualifie un prospect, comment on met en forme le condensé - va dans un skill.
  • Quelque chose qui n'a d'intérêt que pour ce fil - dites-le simplement dans la conversation. C'est retenu tant que cette conversation existe.

L'erreur courante consiste à déverser des documents dans la mémoire longue. Cela fonctionne pendant une semaine, puis chaque réponse devient plus lente, plus coûteuse et plus confuse, parce que l'agent traîne un classeur entier dans chaque conversation. Mettez les documents là où vont les documents.