Nvidia will KI-Agenten stoppen, die ihre Grenzen überschreiten

So arbeiten OpenShell und Sentry und das müssen Firmen prüfen.

Ein KI-Würfel steht in einer transparenten Schutzumgebung, deren Grenze durch ein violettes Schild gesichert ist.

Nvidia hat eine Plattform vorgestellt, die Zugriffe und Aktionen autonomer KI-Agenten technisch begrenzen soll. Die Nvidia Open Agent Safety Platform kombiniert die Laufzeitsoftware OpenShell mit einer unabhängigen Überwachung namens Sentry.

Die Ankündigung vom 28. September 2026 adressiert ein praktisches Sicherheitsproblem: Agenten sollen Aufgaben selbstständig erledigen, dabei aber innerhalb ihrer Berechtigungen bleiben. Nvidia verweist auf Vorfälle, bei denen Systeme Kontrollen auf Anwendungsebene umgangen haben.

Wie relevant diese Grenzen werden, zeigt auch die gestoppte Astra-Veröffentlichung. Dort standen unter anderem Auftragsgrenzen und die nachvollziehbare Rückmeldung ausgeführter Aktionen im Mittelpunkt.

OpenShell setzt Grenzen außerhalb des KI-Modells

OpenShell soll kontrollieren, wie Agenten Aufgaben ausführen und auf Daten, Werkzeuge oder externe Systeme zugreifen. Die Software setzt Richtlinien außerhalb des Agentenprozesses durch.

Dahinter steht eine wichtige Unterscheidung: Anweisungen und Schutzmechanismen im Modell beeinflussen, welche Aktion ein Agent versucht. Laufzeitkontrollen bestimmen dagegen, ob diese Aktion tatsächlich ausgeführt werden darf. Ein Zugriff kann damit technisch blockiert werden, auch wenn der Agent ihn für seine Aufgabe als sinnvoll bewertet.

Sentry ergänzt eine unabhängige Hardwareüberwachung

Sentry bildet eine zusätzliche Kontrollschicht außerhalb der Ausführungsumgebung des Agenten. Das Referenzdesign nutzt Nvidia BlueField-4-Datenprozessoren und DOCA-Software, um Aktivitäten zu überwachen und Sicherheitsrichtlinien durchzusetzen.

Versucht ein Agent, seine Grenzen zu überschreiten, soll Sentry ihn laut Nvidia innerhalb von Millisekunden isolieren und stoppen. Diese Reaktionszeit ist eine Herstellerangabe. Daraus lässt sich keine Garantie ableiten, dass sämtliche unerlaubten Aktionen verhindert werden.

Was von der Nvidia Open Agent Safety Platform verfügbar ist

Nvidia bezeichnet OpenShell als breit verfügbar. Die Software und ergänzende Ressourcen sind über Entwicklerseiten und GitHub zugänglich. Als Open-Source-Software lässt sich OpenShell auch für andere Rechenplattformen erweitern.

Die zusätzliche Sentry-Schicht ist davon zu unterscheiden: Das vorgestellte Referenzdesign sieht BlueField-4-Hardware vor. Unternehmen müssen deshalb für ihre Architektur prüfen, welche Komponenten verfügbar und integrierbar sind.

Technische Kontrollen brauchen klare Berechtigungen

Die Cloud Security Alliance begrüßt insbesondere die Durchsetzung von Grenzen außerhalb der Agentenumgebung. Sie betont zugleich, dass technische Funktionen mit Verantwortlichkeiten und überprüfbaren Sicherheitsanforderungen verbunden werden müssen. Ihre Stellungnahme ist eine Einordnung, kein unabhängiger Wirksamkeitstest der Plattform.

Für IT-Verantwortliche ergeben sich daraus konkrete Prüfpunkte: Welche Daten darf ein Agent lesen? Welche Systeme darf er verändern? Welche Aktionen brauchen eine zusätzliche Freigabe? Und lässt sich später nachvollziehen, was tatsächlich passiert ist?

Diese Fragen stehen auch hinter den geplanten BSI-Prüfanforderungen für KI-Agenten. Eine Sicherheitsplattform kann Richtlinien durchsetzen. Welche Berechtigungen angemessen sind, muss das Unternehmen weiterhin selbst festlegen.

Die Nvidia Open Agent Safety Platform verlagert einen Teil der Kontrolle in die Betriebsumgebung. Für Unternehmen zählt deshalb, ob die vorgesehenen Grenzen in ihrer konkreten Konfiguration nachweisbar funktionieren.

Der IT-Dock-Newsletter ordnet weitere Entwicklungen bei KI-Agenten, Infrastruktur und Security ein.

Weiterführende Artikel

News
30 Sep. 2026 2 Min. Lesezeit

Star Blizzard: Gefälschte Einladungen verbreiten Malware

Microsoft erklärt RedFlick und nennt Schutzmaßnahmen für IT-Teams.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 4 Min. Lesezeit

Microsoft Copilot: Neue Agenten kosten nach Verbrauch

Microsoft Copilot bekommt Home, Code und Autopilot. Die Funktionen starten schrittweise, Agenten kosten nach Verbrauch.

IT-Dock Redaktion Jetzt lesen →
News
30 Sep. 2026 5 Min. Lesezeit

Microsoft-Supportende: Office 2021 und Windows 11 24H2

Microsoft-Supportende im Oktober: das sollten Unternehmen jetzt prüfen.

IT-Dock Redaktion Jetzt lesen →
News
29 Sep. 2026 2 Min. Lesezeit

GPT-6.1 Astra: OpenAI stoppt Veröffentlichung

GPT-6.1 Astra kommt vorerst nicht: OpenAI stoppt die Veröffentlichung nach Tests zu Berechtigungen und Transparenz.

IT-Dock Redaktion Jetzt lesen →
News
29 Sep. 2026 4 Min. Lesezeit

One UI 9: Diese Galaxy-Geräte haben das Update schon

Für ältere Modelle fehlen Termine. Was Samsung bestätigt und IT-Teams prüfen.

IT-Dock Redaktion Jetzt lesen →
News
28 Sep. 2026 4 Min. Lesezeit

Citrix NetScaler: Zwei kritische Lücken werden ausgenutzt

Betroffene Versionen, Updates und Hinweise zur Prüfung auf Kompromittierung.

IT-Dock Redaktion Jetzt lesen →
News
28 Sep. 2026 4 Min. Lesezeit

O2 und 1&1: Telefónica-Chef will nur drei Mobilfunknetze

Der Telefónica-Chef stellt vier Netze infrage. Eine Fusion ist nicht bestätigt. Was hinter der Debatte steckt.

IT-Dock Redaktion Jetzt lesen →
News
28 Sep. 2026 4 Min. Lesezeit

Azure-Abschaltungen: Diese Dienste enden jetzt

Welche Dienste betroffen sind und was Unternehmen vor den Stichtagen prüfen sollten.

IT-Dock Redaktion Jetzt lesen →
News
25 Sep. 2026 4 Min. Lesezeit

ADFGVX-Funkspruch: KI entschlüsselt Nachricht von 1918

Was belegt ist, warum der Schlüssel Fragen aufwirft und was offenbleibt.

IT-Dock Redaktion Jetzt lesen →
News
24 Sep. 2026 3 Min. Lesezeit

Googlebook: Neue KI-Laptops starten im Oktober in Deutschland

Google nennt Preis und Gemini-Funktionen. Für Unternehmen bleiben Fragen offen.

IT-Dock Redaktion Jetzt lesen →

Kommentare (0)

Noch keine Kommentare vorhanden.

Back to top