Dos preguntas separadas
La supervisión en Olano responde a dos preguntas independientes, y mantenerlas separadas hace que los ajustes sean mucho más fáciles de entender.
- ¿Qué acciones requieren aprobación? Una decisión persistente, por agente, construida a partir de un perfil, un par de interruptores y anulaciones opcionales por herramienta.
- ¿Qué ocurre cuando surge una? Una tarjeta en línea si una persona está viendo la conversación, o un elemento en cola en la bandeja de aprobaciones si el turno se ejecutaba sin supervisión.
Niveles de confianza 0-4
Cada agente lleva un nivel de confianza que describe cuánta autonomía se le ha concedido. El valor por defecto para un agente nuevo es el nivel 2.
| Nivel | Nombre | Qué puede hacer |
|---|---|---|
| 0 | Observador | Solo lectura. Puede mirar y sugerir, pero no cambia nada. |
| 1 | Asistente | Puede escribir en su propia memoria y en sus registros. Sigue sin tocar nada fuera de sí mismo. |
| 2 | Colaborador | Puede crear y editar archivos del espacio de trabajo y ejecutar comandos en el entorno que tenga configurado. |
| 3 | Autónomo | Acceso completo al espacio de trabajo, y aprueba automáticamente las operaciones clasificadas como de bajo riesgo. |
| 4 | Desarrollador | El ajuste más amplio, incluido el acceso al shell local, y aprueba automáticamente la mayoría de las operaciones. Pensado para el desarrollo, no para un agente de cara al cliente. |
Las operaciones de alto riesgo requieren una persona en cualquier nivel de confianza. El nivel 4 no significa «nunca hay aprobaciones» - amplía lo que cuenta como rutina, no lo que cuenta como peligroso.
Puertas de aprobación por categoría
La Supervisión en la pestaña Overview de un agente fija la base con un Modo, y cada modo añade una categoría de acciones al conjunto de aprobación:
| Modo | Se retiene para aprobación |
|---|---|
| De confianza | Acciones financieras y escritura de secretos. |
| Supervisado | Lo anterior, más escrituras en sistemas externos, comandos de shell y lectura de secretos. |
| Bloqueado | Lo anterior, más escrituras en el sistema de archivos y delegar trabajo a un subagente. |
Dos interruptores se superponen al modo que hayas elegido: Preguntar antes de acciones de escritura añade escrituras externas, y Preguntar antes de comandos de shell añade shell. Úsalos cuando quieras la soltura general de Confiable, pero no para una categoría concreta.
Por encima de todo está la anulación por herramienta. En la Herramientas , la sección plegada Anulaciones de aprobación (avanzado) enumera cada herramienta seleccionada con su estado efectivo y un Predeterminado / Preguntar siempre / No preguntar nunca de control. Ese ajuste gana al perfil y a los interruptores, que es como fijas que una herramienta peligrosa siempre pregunte en un agente por lo demás de confianza, o al revés para una herramienta que ya has visto funcionar cien veces.
La misma tarjeta también lleva los interruptores de escaneo: comprobar el texto entrante y saliente en busca de información personal, y ocultar secretos en las respuestas. Funcionan con independencia de las aprobaciones.
Responder a una aprobación
Cuando hay una persona observando, la solicitud aparece en línea dentro de la conversación como una tarjeta con una insignia de riesgo y tres botones: Aceptar una vez, Aceptar todo (que aprueba automáticamente el resto de ese turno) y Rechazar. Una tarjeta sin respuesta expira y se trata como un rechazo, así que una conversación olvidada nunca deja una acción pendiente de forma indefinida.
En la cabecera del chat, el de modo anula el ajuste permanente del agente solo para esa conversación:
- Auto : aprueba cada llamada a herramienta de esta sesión. Sin tarjetas.
- Manual : pregunta antes de cada herramienta con barrera.
- Plan : pide al agente que redacte primero un plan. El plan aparece con un botón Aprobar y ejecutar ; para refinarlo, basta con escribir un mensaje de seguimiento mientras sigues en Plan.
- Ejecutar : aprueba todo, para ejecutar un plan que acabas de aprobar.
Plan es el modo que conviene usar las primeras veces que le das a un agente un trabajo con consecuencias. Puedes leer la secuencia prevista antes de que ocurra nada de ella.
La bandeja de aprobaciones
No en todos los turnos hay alguien mirando. Cuando una ejecución programada, una fase autónoma o una tarea delegada por otro agente topa con una herramienta con barrera, la acción se aplaza a la Aprobaciones en la pantalla Resumen y se detiene.
Cada elemento nombra la herramienta, muestra una insignia de riesgo e indica el agente de origen y la ruta por la que llegó la llamada. Aprobar reanuda el turno bloqueado; Rechazar lo termina. El elemento Resumen de la barra lateral lleva un contador en vivo, y ese mismo número mueve la campana de notificaciones, así que una aprobación pendiente se ve desde cualquier sección del panel.
Los elementos de la bandeja mantienen un turno abierto. Si nadie mira la bandeja, el trabajo nocturno que debía enviar el informe se queda ahí parado en vez de ejecutarse. Revísala como parte de la misma rutina con la que consultas los aspectos destacados diarios.
Historial de auditoría
Varias superficies registran lo ocurrido, cada una respondiendo a una pregunta distinta.
| Dónde | Responde |
|---|---|
| Revisiones | Qué cambió en la configuración y en los documentos del espacio de trabajo, cuándo, y el turno de qué agente hizo el cambio. Filtra por un archivo para ver su historial, y visualiza cualquier versión exactamente como era. |
| Diario de trabajo de Insights | Qué se hizo en un día concreto, por agente, con una narración escrita y el uso por agente. |
| Agente a agente | Todos los mensajes entre agentes, con la petición, la respuesta y cuánto tardó. |
| Historial del programador | Si cada ejecución programada se completó o falló. |
| Actividad de Cortex | Qué hizo el motor de mejora por su cuenta, con deshacer de un clic en cada cambio. |
| Registros | El registro de ejecución en bruto, filtrable por nivel: el sitio donde mirar cuando algo no arrancó. |
Revisiones es la sección que conviene conocer antes de necesitarla. Registra de forma automática, y un botón Crear instantánea ahora confirma de inmediato los cambios pendientes cuando acabas de editar algo y quieres que el registro sea exacto.
Límites de uso
Tres límites independientes mantienen acotado el consumo de un agente.
- Límites de frecuencia de mensajes. Por agente, y opcionalmente por canal, en ventanas por minuto, por hora y por día. Fija el valor por defecto de todo el despliegue en Configuración y ajústalo en cualquier agente individual desde su Límites de frecuencia tarjeta. Por encima del límite, el mensaje nunca llega al modelo y se le dice al remitente que lo intente de nuevo en breve. El trabajo programado y autónomo está exento.
- Límites por turno. La Acceso y seguridad limita cuánto puede seguir trabajando un solo turno: un presupuesto de iteraciones más límites de reintento, de modo que un agente atascado se detiene en vez de entrar en bucle.
- El presupuesto diario de razonamiento. Cortex tiene su propio tope diario de ejecuciones autónomas costosas; cuando se agota, las fases autónomas se saltan hasta mañana en lugar de ejecutarse con un modelo más barato. Consulta capítulo 7.
En un despliegue gestionado, el saldo de créditos se ve en Resumen y en Insights, dividido entre lo incluido y lo comprado, con un medidor de reinicio mensual, así que el consumo es algo que vigilas, no que descubres.
El vault de credenciales
Todo secreto que use un agente vive en el Vault Vault, y solo ahí. Los tokens de canal en particular son campos del vault, no campos de configuración: el archivo de configuración de un agente no nombra la credencial de ninguna forma. El vault es solo para administradores cuando las cuentas de equipo están activas.
Cada secreto puede ser compartido o acotado. Una entrada común la usa cada agente; una anulación por agente del mismo nombre le da a un agente su propio valor, que es justo como diez bots de Telegram usan un único nombre de credencial obvio en lugar de diez inventados. La pestaña Variables Vault de un agente gestiona sus propias anulaciones y está disponible para el propietario de ese agente además de para los administradores, mientras que el vault de todo el despliegue sigue siendo solo para administradores.
Los valores nunca se muestran al modelo ni se registran. Cuando cambias uno, las credenciales de las herramientas entran en vigor en el siguiente turno del agente, mientras que las claves de proveedores de modelo y los tokens de canal se leen al arrancar y necesitan un reinicio.
Si el vault está bloqueado, los conectores que necesitan una credencial no arrancan, y una notificación lo indica en Resumen. Desbloquearlo permite que esos agentes se vuelvan a conectar. Un vault bloqueado nunca pierde un valor guardado, simplemente todavía no puede leerlo.