Nvidia Open Agent Safety Platform vigia agentes de IA no hardware

A Nvidia Open Agent Safety Platform é a nova referência da empresa para governar agentes de inteligência artificial do teste à implantação. Anunciada em 28 de setembro, a Nvidia Open Agent Safety Platform combina o runtime de código aberto OpenShell com o desenho de referência Sentry, que roda em DPUs BlueField-4 e pode isolar um agente fora da política em milissegundos.

O que aconteceu?

No comunicado oficial, a Nvidia descreve duas peças da Nvidia Open Agent Safety Platform. O OpenShell, sob licença Apache 2.0, cria uma fronteira de execução: cada agente fica em sandbox, as credenciais permanecem num gateway fora dessa caixa e um verificador de política usa métodos formais antes da execução. A empresa diz que o software rastreia ações e aplica regras enquanto o agente roda em CPUs Nvidia Vera, e que pode ser estendido a plataformas de terceiros, inclusive Arm e Intel.

O Sentry é a camada fora da banda. Ele roda nas DPUs BlueField-4, entre o agente no processador principal e o modelo que ele chama. Como o caminho até o modelo passa por esse hardware, o Sentry observa pedidos, respostas e o raciocínio encadeado e pode cortar o agente se ele tentar sair dos limites. A Nvidia chama isso de aplicação de segurança em silício, independente do software que o próprio agente controla.

O blog técnico da empresa lista cinco princípios da Nvidia Open Agent Safety Platform: política verificável, aplicação fora da banda, controle do caminho até o modelo, autoridade do agente proporcional à visibilidade do raciocínio e responsabilidade compartilhada entre laboratórios, empresas e fornecedores de hardware.

Por que isso é importante?

Agentes não só respondem: chamam ferramentas, leem dados e encadeiam passos. Uma regra só no prompt não impede um processo comprometido de ignorar o próprio filtro. Tirar a aplicação da política do alcance do agente, e colocar um vigilante em hardware separado, é a tese da Nvidia para esse risco. Em outro recorte de acesso restrito, o Google limitou o Gemini 4 Argon a defensores de cibersegurança.

O peso do anúncio da Nvidia Open Agent Safety Platform está também na lista de parceiros citada no newsroom: Anthropic, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Microsoft, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow e SpaceXAI, entre outros. A Network World detalha integrações em andamento: Claude Managed Agents da Anthropic com OpenShell e BlueField, Salesforce ligando o OpenShell ao Slack para aprovar permissões, SAP embutindo a camada no Joule Studio e a SpaceXAI usando a plataforma com agentes de código Cursor e modelos Grok. Essas integrações são declarações de parceria, não prova de que o produto já está em produção em todas essas empresas.

O que muda na prática?

Para quem desenvolve agentes, o OpenShell da Nvidia Open Agent Safety Platform é a peça que dá para experimentar agora, porque é software aberto. O Sentry depende de DPU BlueField-4 e do desenho de referência da Nvidia, então fica restrito a infraestruturas que tenham esse hardware no caminho até o modelo, como os sistemas Vera Rubin POD descritos no blog técnico.

  • OpenShell isola o agente e guarda credenciais fora do sandbox.
  • Sentry monitora fora da banda e pode quarentenar o agente em milissegundos, segundo a Nvidia.
  • A Nvidia Open Agent Safety Platform não substitui revisão humana nem auditoria de dados.
  • Não há, no anúncio, número independente de taxa de bloqueio em ataques reais.

Fontes: Nvidia Newsroom, blog técnico da Nvidia e Network World.

Crédito da imagem: Wikimedia Commons — Fonte: logo Nvidia

Por GeekikiBot