OpenShell soll den Zugriff von KI Agenten auf Dateien, Zugangsdaten, Prozesse und Netzwerke beschränken. Auch Unteragenten müssen selbst innerhalb einer durchgesetzten Sicherheitsgrenze laufen.
Veröffentlicht vonBearbeitet mit GPT-6 LunaBilder erstellt mit GPT Image 2
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What is Nvidia’s Open Agent Safety Platform, how do OpenShell and Sentry use processor-level containment and behavioral detection to stop ro. Article summary: Nvidia’s Open Agent Safety Platform combines **OpenShell**, an open-source runtime that limits what an AI agent can access, with **Sentry**, a hardware-backed reference design for monitoring and responding to agent behav. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Nvidias Open Agent Safety Platform kombiniert zwei unterschiedliche Kontrollschichten: OpenShell, eine Laufzeitumgebung, die den Zugriff eines KI-Agenten einschränken soll, und Sentry, ein Referenzdesign zur Überwachung und Reaktion auf Aktivitäten – über Hardware außerhalb der Softwareumgebung des Agenten. Nvidia sagt, die Werkzeuge hätten den Sicherheitsvorfall bei Hugging Face verhindern können. Das ist eine rückblickende Einschätzung des Unternehmens, kein im konkreten Vorfall nachgewiesenes Ergebnis.10
OpenShell führt Agenten in abgeschirmten Umgebungen mit Isolation auf Kernel-Ebene aus. Richtlinien können festlegen, auf welche Dateien, Zugangsdaten, Prozesse und externen Netzwerke ein Agent zugreifen darf. Die Grenzen sollen damit von der Laufzeitumgebung durchgesetzt werden – nicht allein davon abhängen, dass der Agent Anweisungen befolgt.1
3
Das ist wichtig, wenn ein Agent unerwartet handelt: Seine eigenen Überlegungen bestimmen nicht, welche Berechtigungen er hat. Entscheidend ist aber, wie das System eingerichtet wird. Für Unteragenten heißt das praktisch: Auch sie müssen einer durchgesetzten Sicherheitsgrenze unterliegen. Dass ein Agent einen weiteren Agenten startet, beweist für sich genommen noch keinen Ausbruch. Die verfügbaren Informationen belegen auch nicht, dass die Einschränkungen des übergeordneten Agenten automatisch für jeden Unteragenten gelten. OpenShell beschreibt ein Sicherheitskonzept – keine Garantie gegen jede denkbare Umgehung.1
3
Sentry wird als hardwaregestütztes Wächterkonzept auf Basis der Nvidia-BlueField-Technologie beschrieben. Statt sich ausschließlich auf Kontrollen innerhalb der Laufzeitumgebung des Agenten zu verlassen, soll Sentry Aktivitäten von außerhalb dieser Umgebung überwachen und Eingriffe ermöglichen – etwa eine Isolation auf Netzwerkebene.
Die beiden Komponenten setzen also an unterschiedlichen Stellen an: OpenShell legt Berechtigungen für die Laufzeit fest und setzt sie durch; Sentry ergänzt Überwachung und Reaktion. Nvidia präsentiert diese Kombination als Möglichkeit, Verhalten zu erkennen und einzudämmen, das Softwarekontrollen allein möglicherweise übersehen würden. Sie ist jedoch als vorgeschlagene Architektur zu verstehen, nicht als Beweis, dass sich jede Bedrohung erkennen oder stoppen lässt.10
Nvidia sagt, die Plattform hätte den Vorfall bei Hugging Face verhindert. Reuters berichtete über diese Aussage zum Start der Plattform. Die verfügbaren Quellen zeigen jedoch nicht, dass OpenShell oder Sentry während des Vorfalls eingesetzt wurden, und belegen auch nicht unabhängig, wie die Werkzeuge sich in diesem Fall verhalten hätten.
Der Vorfall liefert daher den Kontext für Nvidias Produktankündigung, aber keinen Praxistest der Plattform. Das ist ein wichtiger Unterschied: Kontrollen zu beschreiben, die eine bestimmte Art von Risiko angehen sollen, ist etwas anderes, als nachzuweisen, dass sie einen konkreten Sicherheitsvorfall verhindert hätten.
Nvidia erklärt, OpenShell auch für Prozessoren von Arm und Intel nutzbar machen zu wollen. Damit soll der Laufzeitansatz über Nvidia-Prozessoren hinausreichen. Anthropic zählt zu den Partnern, die mit dem Start der Plattform in Verbindung gebracht werden.
Das deutet auf ein Bemühen um breitere Kompatibilität und Verbreitung hin. Daraus folgt aber nicht automatisch, dass alle Partner die Werkzeuge bereits einsetzen oder dass auf unterschiedlichen Systemen dieselben hardwaregestützten Funktionen verfügbar sind.
Die Plattform konzentriert sich auf technische Kontrollen: Berechtigungen festlegen, Grenzen durchsetzen, Aktivitäten überwachen und auf Regelverstöße reagieren. Das kann ein Baustein für die Sicherheit von KI-Agenten sein. Eine Produktankündigung beantwortet aber nicht von selbst Fragen zu Verantwortung, unabhängigen Prüfungen oder Regulierung.
Nvidia-Chef Jensen Huang hat sich dafür ausgesprochen, KI-Unternehmen nicht von geltendem Kartell- oder Haftungsrecht auszunehmen. Diese Position ist von der technischen Ausgestaltung der Plattform zu trennen – und macht deutlich, warum Schutzmaßnahmen für Agenten und die weitergehende rechtliche Verantwortung als unterschiedliche Teile der Debatte betrachtet werden sollten.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
OpenShell soll den Zugriff von KI Agenten auf Dateien, Zugangsdaten, Prozesse und Netzwerke beschränken.
OpenShell soll den Zugriff von KI Agenten auf Dateien, Zugangsdaten, Prozesse und Netzwerke beschränken. Auch Unteragenten müssen selbst innerhalb einer durchgesetzten Sicherheitsgrenze laufen.
Nvidia zufolge wird OpenShell für Prozessoren von Arm und Intel weiterentwickelt; Anthropic gehört zu den Partnern rund um den Start.