Kapitel 8

Freigaben und Vertrauen

Entscheiden, was ein Agent von sich aus tun darf, was auf einen menschlichen Klick wartet, und wie man hinterher prüft, was tatsächlich passiert ist.

Alle Kapitel

Zwei getrennte Fragen

Die Aufsicht in Olano beantwortet zwei unabhängige Fragen, und sie getrennt zu halten macht die Einstellungen viel leichter nachvollziehbar.

  1. Welche Aktionen brauchen eine Freigabe? Eine dauerhafte, agentenbezogene Entscheidung, zusammengesetzt aus einem Profil, ein paar Schaltern und optionalen werkzeugbezogenen Überschreibungen.
  2. Was passiert, wenn eine ansteht? Eine eingebettete Karte, wenn ein Mensch das Gespräch verfolgt, oder ein eingereihter Eintrag im Freigabe-Posteingang, wenn die Runde unbeaufsichtigt lief.

Vertrauensstufen 0-4

Jeder Agent trägt eine Vertrauensstufe, die beschreibt, wie viel Autonomie ihm eingeräumt wurde. Der Standard für einen neuen Agenten ist Stufe 2.

StufeNameWas sie kann
0BeobachterNur lesen. Er darf schauen und vorschlagen, ändert aber nichts.
1AssistentDarf in sein eigenes Gedächtnis und seine Logs schreiben. Rührt außerhalb seiner selbst weiterhin nichts an.
2MitwirkenderDarf Workspace-Dateien anlegen und bearbeiten und Befehle in seiner konfigurierten Umgebung ausführen.
3AutonomVoller Workspace-Zugriff, und Operationen mit niedrigem Risiko werden automatisch freigegeben.
4EntwicklerDie weitreichendste Einstellung, einschließlich lokalem Shell-Zugriff, und genehmigt die meisten Vorgänge automatisch. Gedacht für die Entwicklung, nicht für einen Agenten mit Kundenkontakt.
Gilt immer

Risikoreiche Vorgänge brauchen auf jeder Vertrauensstufe einen Menschen. Stufe 4 bedeutet nicht „nie wieder Freigaben“ - sie erweitert, was als Routine zählt, nicht was als gefährlich gilt.

Freigaben je Kategorie

Die Aufsicht -Karte im Overview-Reiter eines Agenten legt mit einem Modus-Regler fest, und jeder Modus fügt der Freigabemenge eine Kategorie von Aktionen hinzu:

ModusWird zur Freigabe zurückgehalten
VertrautFinanzielle Aktionen und das Schreiben von Geheimnissen.
BeaufsichtigtDas oben Genannte, plus Schreibzugriffe auf externe Systeme, Shell-Befehle und das Lesen von Geheimnissen.
AbgeriegeltDas oben Genannte, plus Dateisystem-Schreibzugriffe und das Weiterreichen von Arbeit an einen Subagenten.

Zwei Schalter legen sich über den gewählten Modus, egal welchen: Vor Schreibaktionen fragen fügt externe Schreibvorgänge hinzu, und Vor Shell-Befehlen fragen fügt Shell hinzu. Nutzen Sie sie, wenn Sie die allgemeine Lockerheit der Stufe Vertrauenswürdig möchten, aber nicht für eine bestimmte Kategorie.

Über allem steht die Override-Einstellung pro Werkzeug. Im Werkzeuge -Tab führt der eingeklappte Bereich Freigabe-Überschreibungen (erweitert) listet jedes ausgewählte Werkzeug mit seinem tatsächlichen Status auf, dazu ein Standard / Immer fragen / Nie fragen -Steuerelement. Diese Einstellung setzt sich gegen Profil und Schalter durch - so legen Sie fest, dass bei einem sonst vertrauenswürdigen Agenten ein einziges gefährliches Werkzeug immer nachfragt - oder umgekehrt bei einem Werkzeug, das Sie schon hundertmal beobachtet haben.

Dieselbe Karte trägt auch die Scan-Schalter: Ein- und ausgehenden Text auf personenbezogene Daten prüfen und Geheimnisse aus Antworten verbergen. Diese laufen unabhängig von Freigaben.

Eine Freigabe beantworten

Sieht gerade ein Mensch zu, erscheint die Anfrage direkt im Gespräch als Karte mit Risiko-Badge und drei Schaltflächen: Einmal zulassen, Alles zulassen (die den Rest dieses Zugs automatisch freigibt) und Ablehnen. Eine unbeantwortete Karte läuft ab und wird als Ablehnung gewertet, sodass eine vergessene Unterhaltung eine Aktion nie unbegrenzt hängen lässt.

Im Chat-Kopf befindet sich der -Modus -Chip überschreibt die Daueranweisung des Agenten für genau dieses eine Gespräch:

  • Auto - genehmigt jeden Werkzeugaufruf für diese Sitzung. Keine Karten.
  • Manuell - fragt vor jedem geschützten Werkzeug nach.
  • Tarif - lässt den Agenten zuerst einen Plan entwerfen. Der Plan erscheint mit einer Schaltfläche Freigeben & ausführen -Button; um ihn zu verfeinern, tippen Sie einfach eine Nachfrage, während Sie noch im Plan-Modus sind.
  • Ausführen - genehmigt alles, um einen Plan auszuführen, den Sie gerade erst freigegeben haben.

Plan ist der Modus für die ersten Male, in denen Sie einem Agenten eine Aufgabe mit Konsequenzen geben. Sie lesen die geplante Abfolge, bevor irgendetwas davon passiert.

Der Freigabe-Posteingang

Nicht bei jedem Zug sieht jemand zu. Trifft ein geplanter Lauf, eine autonome Phase oder eine von einem anderen Agenten übertragene Aufgabe auf ein geschütztes Werkzeug, verschiebt sich die Aktion in den Freigaben -Bereich auf dem Übersicht -Bildschirm und pausiert.

Jeder Eintrag nennt das Werkzeug, zeigt ein Risiko-Badge und benennt den auslösenden Agenten sowie den Pfad, über den der Aufruf kam. Freigeben setzt den blockierten Zug fort; Ablehnen beendet ihn. Der Sidebar-Eintrag „Übersicht“ trägt eine Live-Zählung, und dieselbe Zahl treibt die Benachrichtigungsglocke an, sodass eine wartende Freigabe von jedem Bereich des Dashboards aus sichtbar ist.

Achtung

Einträge im Posteingang halten einen Zug offen. Schaut niemand in den Posteingang, bleibt der nächtliche Job, der eigentlich den Bericht verschicken sollte, dort liegen, statt zu laufen. Prüfen Sie ihn als Teil derselben Routine, mit der Sie sich die täglichen Höhepunkte ansehen.

Audit-Historie

Mehrere Bereiche protokollieren, was geschehen ist, jeder beantwortet eine andere Frage.

WoBeantwortet
RevisionenWas sich in Konfiguration und Arbeitsbereichsdokumenten geändert hat, wann, und der Zug welchen Agenten die Änderung vorgenommen hat. Filtern Sie auf eine Datei, um ihre Historie zu sehen, und betrachten Sie jede Version genau so, wie sie war.
Insights-ArbeitstagebuchWas an einem bestimmten Tag erledigt wurde, je Agent, mit geschriebenem Bericht und Nutzung pro Agent.
Agent zu AgentJede Nachricht zwischen Agenten, mit Anfrage, Antwort und Bearbeitungsdauer.
Scheduler-VerlaufOb jeder geplante Lauf erfolgreich war oder fehlschlug.
Cortex-AktivitätWas der Verbesserungsmotor von allein getan hat, mit Ein-Klick-Rückgängig für jede Änderung.
LogsDas rohe Laufzeit-Log, filterbar nach Stufe - die Stelle, an der Sie nachsehen, wenn etwas nicht gestartet ist.

Revisionen ist der Bereich, den es sich lohnt zu kennen, bevor Sie ihn brauchen. Er zeichnet automatisch auf, und eine Jetzt Snapshot erstellen -Button überführt anstehende Änderungen sofort, wenn Sie gerade etwas bearbeitet haben und die Aufzeichnung genau stimmen soll.

Nutzungsobergrenzen

Drei getrennte Grenzwerte halten den Verbrauch eines Agenten in Schranken.

  • Nachrichtenlimits. Pro Agent, und optional pro Kanal, über Fenster pro Minute, pro Stunde und pro Tag. Legen Sie den installationsweiten Standard fest in Konfiguration und schränken Sie ihn bei einzelnen Agenten weiter ein, über deren Ratenlimits -Karte enger fassen. Über dem Limit erreicht die Nachricht das Modell gar nicht erst, und der Absender wird gebeten, es gleich noch einmal zu versuchen. Geplante und autonome Arbeit ist davon ausgenommen.
  • Zug-Limits. Die Zugriff & Sicherheit -Karte begrenzt, wie lange ein einzelner Zug arbeiten darf - ein Iterationsbudget plus Wiederholungsgrenzen -, sodass ein feststeckender Agent stoppt, statt sich zu verschleifen.
  • Das tägliche Denkbudget. Cortex hat sein eigenes Limit für teure autonome Läufe pro Tag; ist es aufgebraucht, setzen autonome Phasen bis morgen aus, statt auf einem günstigeren Modell weiterzulaufen. Siehe Kapitel 7.

Bei einer betreuten Installation ist der Credits-Stand auf Übersicht und in Insights sichtbar, aufgeteilt in Enthaltenes und Zugekauftes, mit einem monatlichen Reset-Zähler - Verbrauch ist also etwas, das Sie beobachten, statt es zu entdecken.

Der Zugangsdaten-Tresor

Jedes Geheimnis, das ein Agent nutzt, liegt im verschlüsselten Vault Vault, und nur dort. Insbesondere Kanal-Tokens sind Vault-Felder, keine Konfigurationsfelder: Die Konfigurationsdatei eines Agenten nennt die Zugangsdaten in keiner Form. Der Vault ist bei aktivierten Teamkonten nur für Administratoren zugänglich.

Jedes Geheimnis kann geteilt oder eingegrenzt sein. Ein gemeinsamer Eintrag wird von jedem Agenten genutzt; eine Agent-eigene Überschreibung desselben Namens gibt einem einzelnen Agenten seinen eigenen Wert - genau so nutzen zehn Telegram-Bots einen einzigen naheliegenden Zugangsdatennamen statt zehn erfundener. Der Variablen -Tab verwaltet die eigenen Überschreibungen und steht dem Besitzer dieses Agenten ebenso offen wie Administratoren, während der installationsweite Vault Administratoren vorbehalten bleibt.

Werte werden dem Modell nie gezeigt und nie protokolliert. Ändern Sie einen Wert, wirken Toolkit-Zugangsdaten ab dem nächsten Zug des Agenten, während Modellanbieter-Schlüssel und Kanal-Tokens beim Hochfahren gelesen werden und einen Neustart brauchen.

Hinweis

Ist der Vault gesperrt, starten Konnektoren, die einen Zugangsdatensatz brauchen, nicht, und eine Benachrichtigung auf Übersicht meldet das. Ihn zu entsperren lässt diese Agenten sich wieder verbinden. Ein gesperrter Vault verliert nie einen gespeicherten Wert - er kann ihn nur noch nicht lesen.