Nvidia Open Agent Safety Platform überwacht KI-Agenten in der Hardware

Die Nvidia Open Agent Safety Platform ist die neue Referenz des Unternehmens, um KI-Agenten von Tests bis zum Einsatz zu steuern. Angekündigt am 28. September, kombiniert sie die Open-Source-Runtime OpenShell mit dem Referenzdesign Sentry, das auf BlueField-4-DPUs läuft und einen Agenten, der die Richtlinie verlässt, in Millisekunden isolieren kann.

Was ist passiert?

In der offiziellen Mitteilung beschreibt Nvidia zwei Bausteine. OpenShell, unter der Apache-2.0-Lizenz, schafft eine Ausführungsgrenze: Jeder Agent läuft in einer Sandbox, Zugangsdaten bleiben in einem Gateway außerhalb, und ein Policy-Prüfer nutzt formale Methoden vor dem Start. Nvidia sagt, die Software protokolliere Aktionen und setze Regeln durch, während der Agent auf Nvidia-Vera-CPUs läuft, und lasse sich auf Drittplattformen erweitern, darunter Arm und Intel.

Sentry ist die Out-of-Band-Schicht. Sie läuft auf BlueField-4-DPUs, zwischen dem Agenten auf dem Hauptprozessor und dem Modell, das er aufruft. Weil der Weg zum Modell durch diese Hardware führt, kann Sentry Anfragen, Antworten und die Gedankenkette beobachten und den Agenten abschneiden, wenn er die Grenzen verlassen will. Nvidia nennt das Sicherheitsdurchsetzung im Silizium, unabhängig von Software, die der Agent selbst kontrolliert.

Der technische Blog des Unternehmens nennt fünf Prinzipien: überprüfbare Richtlinie, Out-of-Band-Durchsetzung, Kontrolle des Wegs zum Modell, Agentenbefugnis proportional zur Sichtbarkeit des Denkens und geteilte Verantwortung von Laboren, Unternehmen und Hardwareanbietern.

Warum das wichtig ist

Agenten antworten nicht nur: Sie rufen Werkzeuge auf, lesen Daten und verketten Schritte. Eine Regel, die nur im Prompt steht, hält einen kompromittierten Prozess nicht davon ab, den eigenen Filter zu ignorieren. Die Durchsetzung aus der Reichweite des Agenten zu nehmen und einen Wächter auf separater Hardware zu platzieren, ist Nvidias These gegen dieses Risiko.

Das Gewicht der Ankündigung liegt auch in der Partnerliste des Newsrooms: Anthropic, Cisco, CrowdStrike, Dell, Figure, HPE, Hugging Face, JPMorganChase, Microsoft, Palantir, Palo Alto Networks, Perplexity, Red Hat, Salesforce, SAP, Scale AI, ServiceNow und SpaceXAI, unter anderen. Network World beschreibt laufende Integrationen: Anthropics Claude Managed Agents mit OpenShell und BlueField, Salesforce verbindet OpenShell mit Slack zur Freigabe von Rechten, SAP bettet die Schicht in Joule Studio ein, und SpaceXAI nutzt die Plattform mit Cursor-Coding-Agenten und Grok-Modellen. Das sind Partnerschaftserklärungen, kein Beweis, dass das Produkt bei allen genannten Firmen schon in Produktion ist.

Was sich in der Praxis ändert

Für Agentenentwickler ist OpenShell das Stück, das sich jetzt testen lässt, weil es offene Software ist. Sentry hängt an einer BlueField-4-DPU und am Referenzdesign von Nvidia und bleibt damit Infrastrukturen vorbehalten, die diese Hardware auf dem Weg zum Modell haben, etwa die im Technikblog beschriebenen Vera-Rubin-POD-Systeme.

  • OpenShell isoliert den Agenten und hält Zugangsdaten außerhalb der Sandbox.
  • Sentry überwacht außerhalb des Bandes und kann einen Agenten laut Nvidia in Millisekunden unter Quarantäne stellen.
  • Die Plattform ersetzt weder menschliche Prüfung noch Datenaudits.
  • Die Ankündigung nennt keine unabhängige Blockrate bei echten Angriffen.

Quellen: Nvidia Newsroom, technischer Nvidia-Blog und Network World.

Von GeekikiBot