Explora interactivamente cómo controlar agentes autónomos mediante aislamiento en Sandbox, chequeos de seguridad pre/post ejecución y evaluación A/B en paralelo.
1. 📄 User Prompt
➔
2. 🛡️ Pre-Guardrail
➔
3. 🔀 Policy Router
➔
4. 📦 Sandbox Exec
➔
5. 🔒 Post-Safety
➔
6. 📝 Audit Log
Módulo 7 — Arquitectura de Control
¿Por qué es indispensable la Gobernanza en Agentes de IA?
A diferencia de un LLM pasivo que solo genera texto, un **Agente IA** ejecuta herramientas (código Python, consultas SQL, APIs externas, comandos de consola). Sin gobernanza, un agente puede borrar bases de datos, filtrar datos sensibles o entrar en bucles infinitos costosos.
💡Analogía: El Piloto Automático y los Controles de Vuelo
Un LLM simple es como un copiloto que da sugerencias verbales. Un Agente IA tiene las manos en los controles del avión (ejecuta herramientas). La Gobernanza es la computadora de vuelo que impide maniobras peligrosas: limita la velocidad (rate limits), encierra al piloto en una cabina blindada (Sandbox) y exige autorización para decisiones críticas (Human-in-the-Loop).
Los 3 Pilares Fundamentales de la Gobernanza:
1. Sandbox Isolation (Aislamiento): El agente ejecuta código y comandos en contenedores aislados (Wasm / microVM) sin acceso al sistema operativo host.
2. Safety Checks & Guardrails: Filtros continuos que interceptan Prompt Injection, enmascaran PII (datos personales) y previenen alucinaciones.
3. A/B Testing & Auditing: Enrutamiento comparativo v1 vs v2 para evaluar seguridad, latencia y costo antes de desplegar a producción.
📦 Sandbox Isolation Engine
Simulador de Entorno Aislado (Sandbox)
Configura los límites de recursos y permisos de ejecución del Agente. Intenta ejecutar comandos para observar cómo la caja de arena atrapa violaciones de seguridad.
Límite de Memoria (RAM)
256 MB
Límite de Tiempo CPU
3 s
Acceso a Red (Network)
Sistema de Archivos (File System)
SANDBOX CONTAINMENT LOGS (Wasm MicroVM)
[00:00:00]SYSTEMSandbox initialized. Resource bounds enforced. Ready for execution.
🧪 Agent A/B Testing & Evaluation
Pruebas A/B Lado a Lado
Compara en tiempo real la ejecución de **Agente V1 (Base sin reglas)** contra **Agente V2 (Con Gobernanza y Guardrails)** ante el mismo prompt del usuario.
Agent V1 (Sin Gobernanza)
Unsafe Baseline
Latencia:420 ms
Costo Tokens:$0.0042
Score de Riesgo:85% (HIGH RISK)
Respuesta / Acción:
⚠️ Ejecutando script `rm -rf /var/log/*` directamente en servidor host sin confirmación...
Agent V2 (Con Gobernanza)
Policy Enforced
Latencia:480 ms
Costo Tokens:$0.0048
Score de Riesgo:4% (SAFE)
Respuesta / Acción:
✅ Guardrail activo: Generado reporte de ventas en /tmp. Comando de eliminación bloqueado por Policy Engine. Solicitando aprobación a Administrador.
Métrica de Evaluación
Agent V1 (Sin Control)
Agent V2 (Con Gobernanza)
Veredicto de Auditoría
Contención Sandbox
❌ Ninguna (Full Host)
✅ Wasm MicroVM Aislada
Aprobado V2
Filtro de Inyección
❌ Desactivado
✅ Pre-Guardrail Activo
Aprobado V2
Protección de PII
❌ Muestra datos crudos
✅ Enmascaramiento Automático
Aprobado V2
🔒 Safety Checks & Guardrails
Chequeos de Seguridad y Enmascaramiento de PII
Prueba cómo los Guardrails interceptan ataques de Prompt Injection y redactan datos sensibles antes de que el agente procese la solicitud.
Entrada Sanitizada (Post-Guardrail Prompt):
Esperando análisis...
Resultado de Seguridad:
Estado: Listo.
⚙️ End-to-End Governance Pipeline
Simulador Paso a Paso del Flujo Completo
Avanza paso a paso para observar la transformación de una consulta desde la entrada del usuario hasta el registro en la cadena de auditoría inmutable.
Paso 1 de 6
Cadena de Auditoría Inmutable (Immutable Audit Hash Chain):