Kapitel 3

Gedächtnis und Wissen

Agenten erinnern sich auf vier verschiedene Arten, und diese sind nicht austauschbar. Zu wissen, in welche man etwas hineinlegt, ist der größte Teil der Kunst.

Alle Kapitel

Die vier Ebenen

EbeneEnthältWird gelesen, wenn
GesprächsgedächtnisAlles, was in diesem einen Gespräch gesagt wurdeBei jeder Runde dieses Gesprächs
LangzeitgedächtnisDauerhafte Fakten und Vorlieben zu Ihnen und der ArbeitBei jeder Runde jedes Gesprächs
WissensdatenbankIhre hochgeladenen Dokumente und gespeicherten WebseitenNur wenn der Agent nach etwas sucht
SkillsVorgehensweisen - wie eine wiederkehrende Aufgabe erledigt wirdWenn die anstehende Aufgabe zu einem Skill passt

Die ersten zwei sind immer im Spiel und kosten daher bei jeder Runde etwas; die zweiten zwei werden bei Bedarf nachgeschlagen und kosten nichts, bis sie gebraucht werden. Genau dieser Unterschied ist der ganze Grund, bewusst zu wählen, wo etwas seinen Platz hat.

Gesprächsgedächtnis

Jedes Gespräch ist ein dauerhafter Thread. Schließen Sie den Browser, kommen Sie nächste Woche wieder, öffnen Sie ihn erneut über die Chat-Leiste - der Agent hat den Kontext noch. Gespräche werden neueste zuerst aufgelistet, mit lesbarem Namen, dem Kanal, aus dem sie kamen, ihrer Nachrichtenzahl und ihren laufenden Kosten.

Ein langes Gespräch bricht nicht zusammen: Nähert es sich der Grenze des Modells, werden ältere Runden an Ort und Stelle verdichtet, sodass der Thread weiterläuft, statt sich zu verzweigen. Die Kontextleiste im Chat-Header zeigt, wie voll das Gespräch gerade ist, und der /context -Befehl öffnet eine Aufschlüsselungskarte - wie viel Platz System-Prompt, Werkzeuge, Gedächtnisdateien, Skills und Nachrichten jeweils einnehmen, und wie viel freier Raum übrig ist.

Hier zählen zwei Befehle. /new startet ein neues Gespräch - der richtige Schritt, sobald Sie das Thema wechseln: Ein sauberer Thread ist günstiger und schärfer als ein langer, der unzusammenhängende Vorgeschichte mitschleppt. /compact fordert eine Verdichtung sofort an, statt auf die Grenze zu warten.

Langzeitgedächtnis

Die Gedächtnis -Bereich ist eine direkte Ansicht des Langzeitgedächtnis-Dokuments des Agenten, das bei jeder einzelnen Runde in seine Anweisungen eingefügt wird. Drei Lesemodi stehen zur Verfügung: Gliederung (Abschnitte und Fakten, filterbar und einklappbar), Lesen (gerendert) und Rohtext (die Markdown-Quelle). Kopieren und Herunterladen tun, was ihr Name sagt.

Sie können auf zwei Arten hineinschreiben. Das Schnell-hinzufügen-Formular hängt eine einzelne Tatsache an: Wählen Sie einen Abschnitt, landet sie im Langzeitgedächtnis; lassen Sie den Abschnitt leer, landet sie stattdessen im heutigen Tageslog. Die Bearbeiten -Schaltfläche öffnet das ganze Dokument zum Bearbeiten - Speichern überschreibt die Datei in einem atomaren Schreibvorgang.

Der Agent pflegt das auch selbst. Eine Hintergrundschleife destilliert jüngste Gespräche zu einem datierten Tageslog und faltet die dauerhaften Teile dieser Logs regelmäßig in das Hauptgedächtnis-Dokument ein. Deshalb wächst das Gedächtnis von selbst, ohne dass jemand hineintippt.

Achtung

Der Ganzdokument-Editor ersetzt die Datei vollständig. Live-Updates pausieren, während Sie bearbeiten, und ändert der Agent die Datei unter Ihnen, warnt ein Banner, dass Speichern die neuere Version überschreiben würde, und bietet stattdessen ein Neuladen an. Lesen Sie dieses Banner, bevor Sie speichern.

Halten Sie das Langzeitgedächtnis kurz. Es wird bei jeder Runde gelesen, sollte also beständige Dinge enthalten - wer die Kunden sind, wie der Hausstil aussieht, welcher Lieferant bevorzugt wird - und kein Protokoll von letztem Dienstag.

Ihre Wissensdatenbank

Die Wissen -Bereich baut aus Dokumenten und Webseiten, die Sie liefern, eine durchsuchbare Sammlung. Fügen Sie einzelne Dateien hinzu, fügen Sie URLs hinzu, legen Sie benannte Speicher an, damit verschiedene Materialbestände getrennt bleiben, synchronisieren Sie ein ganzes Verzeichnis, listen Sie auf, was indiziert wurde, und entfernen Sie Quellen, die Sie nicht mehr wollen. Die Suche läuft über die Wissensdatenbank, den Arbeitsbereich des Agenten, sein Gedächtnis oder einen benutzerdefinierten Speicher.

Hierhin gehören Produkthandbücher, Preislisten, Richtlinien, frühere Angebote und Referenz-PDFs. Der Agent trägt nichts davon im Kopf; er sucht, wenn eine Frage es verlangt, und zitiert, was er findet. Das verankert Antworten in Ihrem Material statt im allgemeinen Training des Modells, und es hält die Kosten für einen großen Bestand bei null, bis er tatsächlich gebraucht wird.

Über den Chat-Composer hochgeladene Dateien landen im Arbeitsbereich des Agenten und sind im Dateien -Bereich unter uploads/ sichtbar. Auch alles, was der Agent erzeugt - ein generiertes Bild, ein Bericht, ein Screenshot - landet dort, weshalb Dateien der richtige Ort sind, wenn Sie das Ergebnis selbst suchen und nicht das Gespräch darüber.

Hinweis

Die Indizierung läuft im Hintergrund und wird absichtlich gedrosselt, damit sie ein laufendes Gespräch nie verlangsamt. Ein großer Upload ist kurz nach Abschluss durchsuchbar, nicht sofort.

Notizen

Die Notizen -Bereich ist ein verlinktes Markdown-Wiki, das der Agent liest und beschreibt. Jede Notiz hat einen Titel, Tags, Aliasse und Quellen, und Notizen verlinken sich gegenseitig; das Lesefenster zeigt beide Richtungen dieses Verlinkungsgraphen als Verweist auf und Referenziert von -Chips, sodass Sie sich durch die Nachbarschaft einer Idee bewegen können. Ein Suchfeld führt eine Stichwortsuche über die ganze Sammlung aus.

Ein Kennzeichen lohnt sich zu kennen: auto-inject. Eine als auto-inject markierte Notiz bekommt ihren Ausschnitt bei jeder Runde in den Kontext des Agenten gedrückt, wie das Langzeitgedächtnis - nützlich für eine Daueranweisung, die ein eigenes Dokument verdient, und begrenzt auf die fünf jüngsten solcher Notizen, damit es nicht heimlich aufbläht. Alles andere wird bei Bedarf nachgeschlagen.

Skills

Ein Skill ist eine beigebrachte Vorgehensweise: ein Ordner mit schriftlichen Anweisungen und, optional, auszuführenden Skripten. Wo der System-Prompt sagt, wer der Agent ist, sagt ein Skill, wie eine bestimmte Aufgabe erledigt wird - die Schritte, das Format, die Prüfungen. Der Agent greift auf den passenden zurück, wenn die Aufgabe dazu passt, und Sie schalten sie pro Agent über den Skills -Reiter der Detailseite des Agenten aus.

Skills stammen aus drei Quellen: den mit der Plattform gebündelten, denen, die für Ihre Installation geschrieben wurden, und denen, die der Agent sich über Cortex selbst beibringt (siehe Kapitel 7). Geben Sie /skills im Chat ein, um aufzulisten, was der aktuelle Agent tatsächlich hat, gruppiert nach Kategorie. Wurde ein Skill vom Sicherheitsaudit zurückgehalten, erscheint er dort ebenfalls, mit Begründung, statt einfach lautlos zu verschwinden.

Skills sind der richtige Ort für alles, was aus Schritten besteht. „Das wöchentliche Kunden-Update entwerfen, indem die Aufgaben der letzten Woche gezogen, nach Konto gruppiert und mit dieser Vorlage abgeglichen werden“ ist ein Skill; der Versuch, das als Absatz im System-Prompt zu kodieren, macht den Prompt bei allem anderen schlechter.

Wohin gehört das?

  • Eine Tatsache, die jede Antwort prägen sollte, - unsere Öffnungszeiten, der Name der Geschäftsführung, der Ton, den wir verwenden - gehört ins Langzeitgedächtnis.
  • Ein Dokument, nach dem jemand fragen könnte, - die 40-seitige Richtlinie, der Katalog, der Bericht von letztem Jahr - gehört in die Wissensdatenbank.
  • Eine wiederholbare Methode, - wie wir einen Lead qualifizieren, wie wir die Zusammenfassung formatieren - gehört in einen Skill.
  • Etwas, das nur für diesen Thread relevant ist - sagen Sie es einfach im Gespräch. Es bleibt in Erinnerung, solange dieses Gespräch besteht.

Der häufige Fehler ist, Dokumente ins Langzeitgedächtnis zu schütten. Das funktioniert eine Woche lang, dann wird jede Antwort langsamer, teurer und konfuser, weil der Agent einen Aktenschrank in jedes Gespräch mitschleppt. Legen Sie Dokumente dorthin, wo Dokumente hingehören.