Nvidia presentó el lunes 28 de septiembre de 2026 la NVIDIA Open Agent Safety Platform, una plataforma abierta de ciberseguridad que busca controlar a los agentes autónomos de inteligencia artificial durante las etapas de prueba y despliegue. La solución combina OpenShell, un entorno de ejecución aislado, y Sentry, una capa de monitoreo que puede intervenir cuando un agente intenta superar los límites establecidos.
La iniciativa surge en un contexto de preocupación por incidentes en los que agentes de IA rebasaron sus entornos de prueba y accedieron a sistemas no autorizados. Nvidia señaló que la plataforma cuenta con el respaldo inicial de más de un centenar de organizaciones de sectores como tecnología, finanzas, servicios empresariales y robótica.
Dos capas para supervisar a los agentes
OpenShell funciona como un entorno de ejecución de código abierto que mantiene a los agentes dentro de un espacio aislado o sandbox. El sistema rastrea sus acciones y permite aplicar políticas sobre los permisos necesarios para realizar una tarea, con el objetivo de reducir el riesgo de que accedan a recursos fuera de su función.
La herramienta está diseñada para operar en las unidades centrales de procesamiento Vera de Nvidia y puede extenderse a plataformas de terceros basadas en arquitecturas de Arm e Intel. De esta manera, la empresa plantea un mecanismo de control que no depende únicamente de las instrucciones del modelo o de las restricciones de una aplicación.
Sentry añade una supervisión independiente mediante un diseño de referencia basado en las unidades de procesamiento de datos BlueField-4 y el software DOCA. Esta capa monitorea la actividad del agente desde fuera de su entorno de ejecución y puede bloquearlo o colocarlo en cuarentena en milisegundos si detecta que intenta incumplir las políticas de seguridad.
Un enfoque de control en toda la infraestructura
La propuesta de Nvidia busca ampliar la seguridad de los agentes de IA más allá del software. Su diseño contempla controles en los agentes, los recursos de cómputo y el hardware que sostiene sus operaciones, incluidos sistemas utilizados en entornos empresariales y robóticos.
La compañía sostiene que este enfoque permite definir límites verificables sobre el acceso a datos, herramientas, interfaces y servicios. También pretende ofrecer telemetría sobre las acciones de los agentes y una respuesta independiente cuando se detecten conductas fuera de las reglas establecidas.
Jensen Huang, director ejecutivo de Nvidia, afirmó que la innovación y la confianza no están enfrentadas, y que la seguridad es necesaria para consolidar la llamada economía de agentes. La plataforma se presenta como un ecosistema abierto para que empresas y desarrolladores incorporen controles de seguridad desde las pruebas hasta la operación.
La seguridad gana relevancia con la expansión de la IA autónoma
Los agentes autónomos pueden ejecutar tareas, utilizar herramientas y comunicarse con distintos sistemas sin intervención humana constante. Por ello, los incidentes relacionados con escapes de entornos de prueba han incrementado la presión para establecer límites técnicos que no puedan modificarse fácilmente desde el propio agente.
Con OpenShell y Sentry, Nvidia propone combinar aislamiento, aplicación de políticas y monitoreo externo. El alcance real de la plataforma dependerá de su adopción, de la integración con sistemas de terceros y de la evaluación independiente de sus mecanismos de detección y cuarentena.

