La seguridad debe separar el modelo de las herramientas y aplicar permisos mínimos. También conviene limitar el número de acciones encadenadas, registrar decisiones y exigir aprobación humana para operaciones sensibles.
La tendencia apunta hacia una arquitectura donde cada agente tenga una identidad propia y un perímetro claramente definido. El futuro de la seguridad de IA no será solamente proteger el modelo: será proteger el ecosistema de herramientas que lo rodea.
Fuente original: https://www.axios.com/2026/08/11/ai-agent-sandbox-cybersecurity-testing