Deux questions distinctes
La supervision dans Olano répond à deux questions indépendantes, et les garder séparées rend les réglages bien plus faciles à comprendre.
- Quelles actions nécessitent une validation ? Une décision persistante, propre à chaque agent, construite à partir d'un profil, de quelques interrupteurs, et de dérogations facultatives par outil.
- Que se passe-t-il quand l'une se présente ? Une carte intégrée si un humain suit la conversation, ou un élément mis en file dans la boîte des validations si le tour tournait sans surveillance.
Niveaux de confiance 0-4
Chaque agent porte un niveau de confiance qui décrit l'autonomie qui lui a été accordée. La valeur par défaut pour un nouvel agent est le niveau 2.
| Niveau | Nom | Ce qu'il peut faire |
|---|---|---|
| 0 | Observateur | Lecture seule. Il peut regarder et suggérer, mais il ne change rien. |
| 1 | Assistant | Peut écrire dans sa propre mémoire et ses journaux. Ne touche toujours à rien en dehors de lui-même. |
| 2 | Collaborateur | Peut créer et modifier des fichiers de l'espace de travail et exécuter des commandes dans son environnement configuré. |
| 3 | Autonome | Accès complet à l'espace de travail, et approbation automatique des opérations classées à faible risque. |
| 4 | Développeur | Le réglage le plus large, avec accès shell local inclus, et approuve automatiquement la plupart des opérations. Destiné au développement, pas à un agent en contact avec les clients. |
Les opérations à haut risque exigent un humain à tout niveau de confiance. Le niveau 4 ne veut pas dire « plus jamais de validation » - il élargit ce qui compte comme routinier, pas ce qui compte comme dangereux.
Points de validation par catégorie
La Supervision dans l'onglet Overview d'un agent définit la base avec un Mode, et chaque mode ajoute une catégorie d'actions à l'ensemble des validations :
| Mode | Retenu pour validation |
|---|---|
| De confiance | Actions financières et écriture de secrets. |
| Supervisé | Ce qui précède, plus les écritures vers des systèmes externes, les commandes shell, et la lecture de secrets. |
| Verrouillé | Ce qui précède, plus les écritures sur le système de fichiers et la délégation de travail à un sous-agent. |
Deux interrupteurs viennent se superposer au mode que vous avez choisi, quel qu'il soit : Demander avant les actions d'écriture ajoute les écritures externes, et Demander avant les commandes shell ajoute le shell. Utilisez-les quand vous voulez la souplesse générale de Fiable, mais pas pour une catégorie précise.
Au-dessus de tout se trouve la dérogation par outil. Dans l'onglet Outils , la section repliée Dérogations de validation (avancé) liste chaque outil sélectionné avec son état effectif et un Par défaut / Toujours demander / Ne jamais demander de contrôle. Ce réglage l'emporte sur le profil et les interrupteurs, ce qui vous permet de figer un outil dangereux pour qu'il demande toujours confirmation sur un agent par ailleurs fiable - ou l'inverse pour un outil que vous avez déjà vu à l'œuvre cent fois.
La même carte porte aussi les interrupteurs d'analyse : vérifier le texte entrant et sortant à la recherche d'informations personnelles, et masquer les secrets dans les réponses. Ils fonctionnent indépendamment des validations.
Répondre à une validation
Quand un humain observe, la demande apparaît directement dans la conversation sous la forme d'une carte avec un badge de risque et trois boutons : Accepter une fois, Tout accepter (qui valide automatiquement le reste de ce tour) et Refuser. Une carte sans réponse expire et est traitée comme un refus, de sorte qu'une conversation oubliée ne laisse jamais une action en attente indéfiniment.
Dans l'en-tête de la discussion, la de mode remplace le réglage permanent de l'agent pour cette seule conversation :
- Auto : valide chaque appel d'outil de cette session. Aucune carte.
- Manuel : demande avant chaque outil soumis à validation.
- Offre : demande à l'agent de rédiger d'abord un plan. Le plan apparaît avec un bouton Valider et exécuter ; pour l'affiner, il suffit de taper un message de suivi tant que vous êtes encore en mode Plan.
- Exécuter : valide tout, pour exécuter un plan que vous venez d'approuver.
Plan est le mode à utiliser les premières fois que vous confiez à un agent une tâche à conséquences. Vous pouvez lire la séquence prévue avant qu'aucune d'elle ne se produise.
La boîte des validations
Il n'y a pas toujours quelqu'un qui observe. Quand une exécution planifiée, une phase autonome ou une tâche déléguée par un autre agent tombe sur un outil soumis à validation, l'action est reportée dans la Validations sur l'écran Vue d'ensemble et se met en pause.
Chaque élément nomme l'outil, affiche un badge de risque et identifie l'agent d'origine ainsi que le chemin par lequel l'appel est arrivé. Valider relance le tour bloqué ; Refuser y met fin. L'élément Aperçu de la barre latérale porte un compteur en direct, et ce même chiffre alimente la cloche de notification, si bien qu'une validation en attente est visible depuis n'importe quelle section du tableau de bord.
Les éléments de la boîte maintiennent un tour ouvert. Si personne ne regarde la boîte, la tâche nocturne censée envoyer le rapport reste là au lieu de s'exécuter. Vérifiez-la dans le cadre de la même routine que celle des faits marquants quotidiens.
Historique d'audit
Plusieurs surfaces enregistrent ce qui s'est passé, chacune répondant à une question différente.
| Où | Répond à |
|---|---|
| Révisions | Ce qui a changé dans la configuration et les documents de l'espace de travail, quand, et le tour de quel agent a fait la modification. Filtrez sur un fichier pour voir son historique, et affichez n'importe quelle version telle qu'elle était exactement. |
| Journal de travail Insights | Ce qui a été fait un jour donné, par agent, avec un récit rédigé et l'usage par agent. |
| Agent à agent | Tous les messages entre agents, avec la demande, la réponse et le temps que cela a pris. |
| Historique du planificateur | Si chaque exécution planifiée a réussi ou échoué. |
| Activité de Cortex | Ce que le moteur d'amélioration a fait de lui-même, avec l'annulation en un clic pour chaque changement. |
| Journaux | Le journal d'exécution brut, filtrable par niveau - l'endroit où regarder quand quelque chose n'a pas démarré. |
Révisions est la section qu'il vaut la peine de connaître avant d'en avoir besoin. Elle enregistre automatiquement, et un bouton Instantané maintenant valide immédiatement les modifications en attente lorsque vous venez de modifier quelque chose et voulez que l'enregistrement soit exact.
Plafonds d'utilisation
Trois limites distinctes maintiennent la consommation d'un agent dans des bornes.
- Limites de débit des messages. Par agent, et éventuellement par canal, sur des fenêtres par minute, par heure et par jour. Définissez la valeur par défaut pour tout le déploiement dans Configuration et resserrez-la sur un agent en particulier depuis sa carte Limites de débit . Au-delà de la limite, le message n'atteint jamais le modèle et l'expéditeur est invité à réessayer sous peu. Le travail planifié et autonome en est exempté.
- Limites par tour. La Accès et sécurité plafonne la durée pendant laquelle un seul tour peut continuer à travailler - un budget d'itérations plus des limites de nouvelles tentatives - afin qu'un agent bloqué s'arrête au lieu de boucler.
- Le budget de raisonnement quotidien. Cortex a son propre plafond quotidien pour les exécutions autonomes coûteuses ; une fois épuisé, les phases autonomes sont sautées jusqu'au lendemain plutôt que de tourner sur un modèle moins cher. Voir chapitre 7.
Sur un déploiement infogéré, le solde de crédits est visible dans Aperçu et dans Insights, réparti entre ce qui est inclus et ce qui a été acheté, avec une jauge de remise à zéro mensuelle - la consommation est donc quelque chose que vous surveillez plutôt que vous ne découvrez.
Le coffre d'identifiants
Tout secret utilisé par un agent vit dans le Coffre Coffre, et nulle part ailleurs. Les jetons de canal en particulier sont des champs du coffre, pas des champs de configuration : le fichier de configuration d'un agent ne nomme l'identifiant sous aucune forme. Le coffre est réservé aux administrateurs quand les comptes d'équipe sont activés.
Chaque secret peut être partagé ou cantonné. Une entrée commune est utilisée par tous les agents ; une dérogation par agent portant le même nom donne à un agent sa propre valeur - c'est exactement comme ça que dix bots Telegram utilisent un seul nom d'identifiant évident plutôt que dix noms inventés. L'onglet Variables Coffre d'un agent gère ses propres dérogations et est accessible au propriétaire de cet agent comme aux administrateurs, tandis que le coffre de tout le déploiement reste réservé aux administrateurs.
Les valeurs ne sont jamais montrées au modèle ni journalisées. Quand vous en changez une, les identifiants de la boîte à outils prennent effet au tour suivant de l'agent, tandis que les clés des fournisseurs de modèles et les jetons de canal sont lus au démarrage et nécessitent un redémarrage.
Si le coffre est verrouillé, les connecteurs qui ont besoin d'un identifiant ne démarrent pas, et une notification l'indique dans Aperçu. Le déverrouiller permet à ces agents de se reconnecter. Un coffre verrouillé ne perd jamais une valeur stockée - il ne peut simplement pas encore la lire.