OPERA CON CONFIANZA
Corre agentes en producción.
Puedes poner agentes a trabajar de verdad porque puedes ver, y permitir, todo lo que hacen. Las lecturas fluyen; las escrituras esperan a una persona. El alcance se aplica en la base de datos. Y cada acción aterriza en un registro a prueba de manipulación que puedes exportar.
EL CHECKPOINT
Las lecturas fluyen. Las escrituras te esperan.
Un agente lee con libertad, pero en cuanto quiere cambiar algo el turno se suspende y pregunta, en lenguaje claro, no un diff. Apruébalo una vez, apruébalo para toda la sesión, o niégalo. Una negativa no es un callejón sin salida: guía al agente hacia otro enfoque.
El asistente pide permiso para crear el usuario “m.torres@acme.co” con el rol “analista”.
Negar guía al agente; se adapta y propone otro camino.
Catálogo de herramientas
records__list records__get schema__describe audit__read MODO PLAN
Las herramientas de escritura no están bloqueadas. No están.
En modo plan el agente literalmente no tiene herramientas de escritura en su catálogo; solo puede leer y proponer. Nada que eludir, porque no hay nada ahí. La superficie de escritura aparece solo después de que una persona presiona “Iniciar implementación”.
ALCANCE POR CONSTRUCCIÓN
Un agente solo puede tocar aquello a lo que está acotado.
El alcance no es una instrucción del prompt que el modelo pueda esquivar hablando; se aplica por debajo del agente, en la plataforma.
Aislamiento de tenant en la base de datos
La seguridad a nivel de fila aplica la frontera del tenant en el propio Postgres. Ninguna consulta, humana o de agente, la cruza.
Superficies de herramientas por vista
Un agente ligado a una vista obtiene exactamente las acciones que esa vista expone: los botones que una persona pulsaría, y nada más.
Fijado a un solo registro
Un agente por registro queda fijado al único registro que tienes abierto. No puede desviarse hacia otro.
El piso de seguridad rechaza el resto
Un argumento entre tenants o entre registros se rechaza en el piso de política antes de ejecutarse, y el rechazo se registra como una fila bloqueada en el log, de modo que un intento es tan visible como un éxito.
EL REGISTRO
Cada acción, encadenada por hash y firmada.
Cada invocación de herramienta se vuelve una fila en una cadena hash SHA-256 por tenant, con un recibo de decisión firmado: quién, qué, qué política y el resultado. El log es filtrable y se exporta a JSON o CSV: un registro a prueba de manipulación de todo lo que un agente hizo, y de todo lo que se le negó.
- Un recibo de decisión firmado en cada fila: principal, herramienta, política y resultado.
- Encadenado por hash por tenant, así el registro es a prueba de manipulación.
- Filtra el log y expórtalo a JSON o CSV.
Roadmap En el roadmap: un Evidence File portable que puedes entregar a un tercero.
APRUEBA DONDE SEA
Un Checkpoint. Tres lugares para responderlo.
La misma aprobación te alcanza donde estés: el riel web junto al agente, la línea de tiempo del ticket, o tu teléfono. La decisión es la misma; el lugar lo eliges tú.
Aprobado
send_email · confirmado en el dispositivo
El riel web
La tarjeta de aprobación va justo al lado de la transcripción del agente, con la explicación en lenguaje claro en línea.
La línea de tiempo del ticket
Cuando un agente trabaja un ticket, su diagnóstico en modo plan y sus aprobaciones viven en el propio ticket.
Tu teléfono
La barra de chat se transforma en la tarjeta de aprobación con argumentos enmascarados y una cuenta regresiva; aprueba en movimiento.
En el móvil, las herramientas sensibles pueden exigir Face ID o huella antes de ejecutarse, una compuerta biométrica en el dispositivo sobre la propia aprobación.
Verdict
APROBADO
0.94
score
20 / 20
Grupos de compuertas
- Alcance respetado
- Aprobaciones honradas
- Sin alcance entre tenants
- Respuestas fundamentadas
CALIFICADOS ANTES DE SALIR
Tú calificas al agente, y ves la rúbrica.
Un harness de evaluación corre tus agentes contra 20 grupos de compuertas, y un Agente-como-Juez devuelve un Verdict con una rúbrica por criterio. Un observador en vivo transmite el razonamiento del juez mientras califica, así un agente aprobado es un resultado mostrado, no una afirmación.
POSTURA DE DESPLIEGUE
Dónde corre, y a quién responde.
- Tu clúster o el nuestro
- Despliega en tu propio Kubernetes, o córrelo gestionado. La misma plataforma en ambos casos.
- SSO con Keycloak
- Autentica contra Keycloak, y los roles que ya administras se mapean directo.
- Multi-tenant por construcción
- El aislamiento de tenant se aplica en la base de datos, no atornillado por función.
OPERA CON CONFIANZA
Ve todo. Permite lo que debe pasar.
Pon agentes en trabajo de producción con un Checkpoint en cada escritura, alcance aplicado en la base de datos, y un registro a prueba de manipulación que puedes exportar.