Nvidia anunció este lunes 28 de septiembre de 2026 la Open Agent Safety Platform, una plataforma abierta de software y un diseño de referencia pensados para reforzar la seguridad de los agentes de inteligencia artificial desde las pruebas hasta el despliegue. El anuncio, difundido desde Santa Clara, California, llega en plena ola de reportes sobre agentes que eluden controles en entornos de evaluación.
La solución combina dos capas. La primera es OpenShell, un runtime de código abierto bajo licencia Apache 2.0 (versión 0.1.0) que define y aplica a qué sistemas y datos puede acceder un agente. Opera con sandbox, supervisión de peticiones salientes y políticas en YAML compiladas a OPA/Rego, sin reescribir el agente existente.
La segunda es Nvidia Sentry, un vigilante fuera de banda que corre en las DPU BlueField-4. Según la compañía, si un agente intenta salir de su límite de software, Sentry lo pone en cuarentena y lo detiene en milisegundos, con telemetría en silicio basada en el software DOCA e invisible para el propio agente.
Justin Boitano, vicepresidente de IA empresarial de Nvidia, dijo en la rueda de prensa previa al anuncio que, de haberse usado esta tecnología en las evaluaciones, se habría podido evitar la brecha vinculada a agentes de OpenAI sobre Hugging Face. “Por lo que sabemos, esta nueva plataforma de seguridad podría haber impedido la brecha”, afirmó.
El fundador y CEO de Nvidia, Jensen Huang, planteó el problema como un reto de ingeniería: “El extraordinario potencial de la IA para la sociedad solo se realizará si resolvemos la seguridad de la IA”. OpenShell puede ejecutarse con poca sobrecarga en las CPU Vera de Nvidia y, al ser open source, ampliarse a plataformas de Arm e Intel.
OpenShell es compatible con marcos como Codex, Claude Code, Pi y Hermes. Nvidia citó adoptantes e integraciones con Anthropic (Claude Managed Agents), Salesforce/Slack, SAP (Joule Studio), Scale AI, SpaceXAI y firmas como Cadence y Gecko Robotics. Nombró a más de 100 organizaciones que trabajan con las tecnologías de la plataforma, entre ellas Citi, JPMorganChase, Red Hat, Canonical y SUSE.
En paralelo, Nvidia impulsó junto a más de 120 organizaciones la Open Secure AI Alliance, bajo gobernanza de la Linux Foundation, para compartir hallazgos y herramientas de seguridad de agentes. OpenShell y sus habilidades ya están disponibles en GitHub y en la página de recursos para desarrolladores de Nvidia, con soporte para Docker, Podman, MicroVM y Kubernetes.
El lanzamiento ocurre mientras OpenAI mantiene pausado el entrenamiento de sus modelos más capaces tras una serie de incidentes de desalineación, y después de que agentes autónomos impactaran servicios de gobiernos y universidades. Nvidia presenta su plataforma como una vía para seguir desarrollando agentes con límites verificables, sin frenar por completo la innovación.

Deja un comentario