NVIDIA kuendigte am 28. September 2026 die Open Agent Safety Platform an und beschrieb sie als offene Softwareplattform und Referenzsystemdesign zur Sicherung von KI-Agenten von Tests bis Deployment. Im Zentrum stehen OpenShell, Open-Source-Runtime-Software fuer Agentengrenzen, und NVIDIA Sentry, ein Referenzdesign fuer Out-of-Band-Monitoring und Enforcement auf BlueField-4 DPUs.
Das ist eine relevante KI-Infrastrukturnachricht, weil sie Agenten-Governance unter die Chat- oder Anwendungsschicht verlagert. NVIDIAs Argument lautet, dass lang laufende Agenten Grenzen brauchen, die ausserhalb des Modells und Agent Harness erzwungen werden, besonders wenn Agenten Tools, Daten, APIs, Code, Robotiksysteme oder Enterprise-Workflows erreichen koennen.
Was NVIDIA angekuendigt hat
NVIDIA sagt, OpenShell stelle eine sichere Runtime-Grenze bereit, die Agentenaktionen nachzeichnet und Policy durchsetzt, waehrend Agenten auf NVIDIA Vera CPUs laufen. Das Unternehmen sagt, OpenShell sei jetzt breit verfuegbar und koenne auf Compute-Plattformen Dritter erweitert werden, darunter Arm und Intel.
Sentry ist anders. Es ist ein Referenzsystemdesign, das auf NVIDIA BlueField-4 DPUs laeuft, Agentenverhalten unabhaengig ueberwacht und Agenten quarantainieren kann, wenn sie versuchen, ihre Grenzen zu verlassen. NVIDIA beschreibt dies als In-Silicon-Enforcement aus einer isolierten Trust Domain.
Die Ankuendigung nennt auch eine grosse Partnergruppe, darunter Anthropic, HPE, Microsoft, Salesforce, SAP, Scale AI, Palo Alto Networks und andere. HPE sagt separat, OpenShell sei jetzt allgemein verfuegbar und HPE Private Cloud AI integriere es, wobei HPE-spezifische Verfuegbarkeit fuer Q4 2026 geplant sei. Diese Unterscheidung ist wichtig: OpenShell-Verfuegbarkeit ist aktuell, einige Enterprise-Integrationen bleiben geplant oder deploymentabhaengig.
Warum das wichtig ist
Jüngste Agentenvorfaelle haben einen Punkt schwer uebersehbar gemacht. Ein Prompt kann sagen "bleib im Scope", aber der Agent braucht trotzdem eine Umgebung, die Dateizugriff, Netzwerkzugriff, Tool Calls, Identitaet, Ausfuehrung und Eskalation begrenzt. Die Enforcement-Grenze sollte nicht nur vom selben Modell abhaengen, das entscheidet, was zu tun ist.
Fuer Governance- und Compliance-Teams veraendert das die Evidenzfrage. Eine Runtime-Grenze kann Akten erzeugen, die zeigen, was der Agent versucht hat, welche Policy galt, welche Ausnahme angefragt wurde, was ein Mensch genehmigt hat und welcher Endeffekt eintrat. Das ist nuetzlicher als ein Policy-Dokument, das nicht beweisen kann, ob es zur Aktionszeit hielt.
Der Maetra-Vergleich zu Runtime Guardrails trifft dieselbe Unterscheidung. Policy Review ist noetig, aber Agentenarbeit braucht auch Enforcement zur Aktionszeit und Evidenz.
Was Kaeufer testen sollten
Der Launch ist vielversprechend, aber Organisationen sollten den exakten Deployment-Pfad validieren. OpenShell sollte gegen die Agenten-Frameworks, Tool Calls, Netzwerkziele, Dateisysteme und Identitaetsanbieter getestet werden, die wirklich im Einsatz sind. Teams sollten auch bestaetigen, wie Audit Events exportiert werden, wie Ausnahmegenehmigungen an exakte Aktionen gebunden sind und was passiert, wenn ein Modell mehr Berechtigung anfragt.
Bei Sentry und Hardware Enforcement sollten Kaeufer pruefen, welche Hardware erforderlich ist, ob das Referenzdesign fuer ihre Umgebung verfuegbar ist und wie Monitoring funktioniert, wenn Agenten ueber Cloud, On-Premises, Robotik oder Drittanbieter-Compute laufen.
Was unklar bleibt
Die oeffentliche Ankuendigung beweist Effektivitaet, False-Positive-Raten, Quarantaene-Zuverlaessigkeit oder Kundenergebnisse nicht unabhaengig. Partnerzitate zeigen Oekosysteminteresse, nicht einheitliches Produktionsdeployment. Einige Integrationen und hardwarebasierte Kontrollen haengen von Produktlaufzeiten oder Partner-Releaseplaenen ab.
Maetra-Analyse
NVIDIA zeigt auf die richtige Schicht. Die naechste Generation der Agentensicherheit wird nicht nur aus besseren Prompts oder besseren Modell-Refusals bestehen. Sie wird aus durchsetzbaren Task-Grenzen, Runtime-Policies, Identitaeten, Human-Approval-Pfaden und Evidenz bestehen, die nach der Aktion erhalten bleibt.
Das staerkste Governance-Muster ist geschichtet. Inventarisieren Sie Agenten und Faehigkeiten. Definieren Sie, was jeder Agent lesen, schreiben, ausfuehren und aufrufen darf. Routen Sie Ausnahmen nur dann an Menschen, wenn Policy es verlangt. Bewahren Sie Policy-Entscheidung, Runtime Trace und Endeffekt auf. Testen Sie die Grenze dann mit Fehlerfaellen, nicht nur Happy Paths.
Wenn OpenShell und aehnliche Systeme verbreitet werden, werden Agenten-Sicherheitsreviews konkreter. Die Frage verschiebt sich von "Haben wir dem Modell gesagt, das nicht zu tun?" zu "Welche Grenze hat die Regel durchgesetzt, welche Evidenz hat sie erzeugt und was aenderte sich nach der Ausnahme-Anfrage?"
Quellen
Primaerquelle: NVIDIA-Ankuendigung zur Open Agent Safety Platform.
Bestaetigung: HPE zu NVIDIAs Governed-Agentic-AI-Integration.