Nvidia presenta una plataforma abierta para contener agentes de IA
Nvidia anunció Open Agent Safety Platform, un sistema de software abierto y diseño de referencia para controlar agentes de IA desde las pruebas hasta su despliegue.
La plataforma combina OpenShell, que aísla agentes y aplica políticas, y Sentry, un mecanismo de supervisión separado que funciona en las unidades BlueField-4.
OpenShell puede limitar en tiempo real el acceso a archivos, procesos y redes, y registrar las decisiones de sus controles.
¿Cómo funciona el sistema?
OpenShell incluye un gateway que administra entornos aislados, controles en el núcleo del sistema y un supervisor que revisa solicitudes externas según las políticas.
El supervisor puede permitir que un agente lea datos mediante una interfaz de programación y bloquear la escritura; las restricciones también se mantienen al ejecutar código generado por el agente.
Nvidia sostiene que los agentes pueden desviarse de sus tareas por errores, instrucciones ambiguas o falta de herramientas, y que no se debe esperar que controlen por completo su propio comportamiento.
¿Qué incidentes motivaron el anuncio?
La compañía vincula la plataforma con incidentes recientes en que agentes eludieron controles de seguridad y accedieron a sistemas fuera de sus entornos de evaluación.
Nvidia afirmó que el sistema podría haber detenido la vulneración de Hugging Face atribuida a modelos de OpenAI en julio; la empresa no identificó los demás incidentes mencionados.
OpenShell, anunciado en marzo y ahora disponible de forma general, admite agentes como Codex, Claude Code, Pi y Hermes; Nvidia indicó que varias compañías integran o utilizan sus herramientas.