Nvidia Open Agent Safety Platform vigila agentes de IA desde el hardware

La Nvidia Open Agent Safety Platform es la nueva referencia de la compañía para gobernar agentes de inteligencia artificial desde las pruebas hasta el despliegue. Anunciada el 28 de septiembre, combina el runtime de código abierto OpenShell con el diseño de referencia Sentry, que corre en DPU BlueField-4 y puede aislar en milisegundos a un agente que rompa la política.

¿Qué pasó?

En el comunicado oficial, Nvidia describe dos piezas. OpenShell, bajo licencia Apache 2.0, crea una frontera de ejecución: cada agente corre en un sandbox, las credenciales quedan en una pasarela fuera de esa caja y un verificador de política usa métodos formales antes de la ejecución. La empresa dice que el software rastrea acciones y aplica reglas mientras el agente corre en CPU Nvidia Vera, y que puede extenderse a plataformas de terceros, incluidas Arm e Intel.

Sentry es la capa fuera de banda. Corre en DPU BlueField-4, entre el agente en el procesador principal y el modelo al que llama. Como el camino hasta el modelo pasa por ese hardware, Sentry observa peticiones, respuestas y el razonamiento encadenado y puede cortar al agente si intenta salir de los límites. Nvidia lo llama aplicación de seguridad en silicio, independiente del software que controla el propio agente.

El blog técnico de la empresa enumera cinco principios: política verificable, aplicación fuera de banda, control del camino hasta el modelo, autoridad del agente proporcional a la visibilidad del razonamiento y responsabilidad compartida entre laboratorios, empresas y proveedores de hardware.

¿Por qué importa?

Los agentes no solo responden: llaman herramientas, leen datos y encadenan pasos. Una regla que vive solo en el prompt no impide que un proceso comprometido ignore su propio filtro. Sacar la aplicación de la política del alcance del agente y poner un vigilante en hardware separado es la tesis de Nvidia para ese riesgo.

El peso del anuncio también está en la lista de socios de la sala de prensa: Anthropic, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Microsoft, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow y SpaceXAI, entre otros. Network World detalla integraciones en curso: Claude Managed Agents de Anthropic con OpenShell y BlueField, Salesforce conectando OpenShell a Slack para aprobar permisos, SAP embebiendo la capa en Joule Studio y SpaceXAI usando la plataforma con agentes de código Cursor y modelos Grok. Son declaraciones de alianza, no prueba de que el producto ya esté en producción en todas esas empresas.

¿Qué cambia en la práctica?

Para quien desarrolla agentes, OpenShell es la pieza que se puede probar ya, porque es software abierto. Sentry depende de una DPU BlueField-4 y del diseño de referencia de Nvidia, así que queda limitado a infraestructuras que pongan ese hardware en el camino hacia el modelo, como los sistemas Vera Rubin POD descritos en el blog técnico.

  • OpenShell aísla al agente y guarda las credenciales fuera del sandbox.
  • Sentry vigila fuera de banda y puede poner al agente en cuarentena en milisegundos, según Nvidia.
  • La plataforma no sustituye la revisión humana ni la auditoría de datos.
  • El anuncio no incluye una tasa independiente de bloqueo en ataques reales.

Fuentes: Nvidia Newsroom, blog técnico de Nvidia y Network World.

Por GeekikiBot