← Zur Übersicht aller Beiträge
Nvidia verlagert Agenten-Sicherheit aus dem Modell heraus
Nvidias Open Agent Safety Platform setzt Grenzen für KI-Agenten außerhalb des Agentenprozesses durch. OpenShell kontrolliert Zugriffe in der Laufzeitumgebung, Sentry ergänzt eine unabhängige Hardware-Ebene.
Nvidia verlagert Agenten-Sicherheit aus dem Modell heraus
Nvidias Open Agent Safety Platform setzt Grenzen für KI-Agenten außerhalb des Agentenprozesses durch. OpenShell kontrolliert Zugriffe in der Laufzeitumgebung, Sentry ergänzt eine unabhängige Hardware-Ebene.
KI-Agenten bekommen Zugriff auf Dateien, Anwendungen, APIs und Zugangsdaten. Damit wird eine Frage wichtiger, die bei klassischen Chatbots kaum eine Rolle spielte: Was passiert, wenn der Agent selbst seine Grenzen überschreitet?
Nvidia hat darauf am 28. September eine bemerkenswerte technische Antwort vorgestellt. Die neue Open Agent Safety Platform verlagert einen Teil der Kontrolle bewusst aus dem KI-Modell und aus dem Agentenprogramm heraus.
Der erste Baustein heißt OpenShell. Die quelloffene Laufzeitumgebung setzt Regeln dafür durch, auf welche Dateien, Netzwerke und Werkzeuge ein Agent zugreifen darf. Standardmäßig ist nichts erlaubt; Rechte werden über Richtlinien vergeben. Entscheidend ist: Diese Regeln laufen außerhalb des Agentenprozesses. Ein Prompt oder eine Fehlentscheidung des Agenten kann sie deshalb nicht einfach umschreiben.
Der zweite Baustein geht noch weiter. Sentry ist als unabhängiger Wächter auf Nvidias BlueField-4-DPU vorgesehen. Die Überwachung läuft damit getrennt vom eigentlichen Agenten und vom Host-System. Versucht ein Agent seine festgelegten Grenzen zu verlassen, soll Sentry ihn laut Nvidia innerhalb von Millisekunden isolieren können.
Das ist mehr als ein neues Sicherheitsprodukt. Es zeigt einen Architekturwechsel.
Bisher konzentrierte sich ein großer Teil der KI-Sicherheitsdiskussion darauf, einem Modell beizubringen, welche Handlungen erlaubt sind. Bei Agenten reicht das nicht. Ein System, das selbstständig Werkzeuge bedienen kann, braucht zusätzlich technisch erzwungene Grenzen – ähnlich wie Benutzerrechte, Sandboxes und Netzwerkregeln in klassischer IT.
Nvidia formuliert dieses Prinzip bei OpenShell sehr klar: Sicherheit soll in der Umgebung liegen, nicht nur im Modell oder in der Anwendung. Jeder Agent läuft in einer isolierten Sandbox; Zugriffe werden kontrolliert und Entscheidungen über Erlauben oder Blockieren bleiben protokollierbar.
Dass dieser Ansatz nicht nur ein Nvidia-Sonderweg ist, zeigt die Unterstützung aus dem Ökosystem. Mehr als 100 Organisationen arbeiten laut Nvidia mit Technologien der Plattform, darunter Microsoft, SAP, Anthropic, Salesforce, JPMorganChase und Siemens. Unabhängige Berichterstattung bestätigt die breite Beteiligung und ordnet die Plattform als Reaktion auf die wachsende Sorge vor Agenten ein, die eigenständig unerwünschte Aktionen ausführen.
Wichtig ist dabei die Trennung zwischen verfügbarer Technik und Ankündigung: OpenShell ist bereits als Software verfügbar und kann auch ohne BlueField-4 auf unterstützter Infrastruktur eingesetzt werden. Sentry ist die zusätzliche hardware-isolierte Ebene des Referenzdesigns. Die Aussage, Agenten in Millisekunden stoppen zu können, stammt von Nvidia und ist keine unabhängige Leistungsprüfung.
Für Unternehmen ergibt sich daraus eine praktische Konsequenz: Je mehr KI nicht nur antwortet, sondern tatsächlich handelt, desto weniger darf Sicherheit davon abhängen, dass das Modell sich korrekt verhält.
Ein autonomer Arbeitsschritt braucht nicht nur eine Anweisung, sondern eine technisch durchsetzbare Grenze. Welche Daten darf der Agent sehen? Welche Aktion darf er ausführen? Welche Rechte besitzt er nicht? Und was stoppt ihn, wenn seine eigene Logik versagt?
Damit nähert sich Agenten-KI einem Grundprinzip guter IT-Sicherheit an: Vertrauen allein reicht nicht. Kontrolle muss außerhalb des Systems liegen, das kontrolliert werden soll.
Konzept, Auswahlkriterien und inhaltliche Vorgaben stammen von Christian Hohlfeld. Recherche und Formulierung wurden nach diesen Vorgaben mit KI-Werkzeugen unterstützt. Redaktionell geprüft und verantwortlich: Christian Hohlfeld.
Nvidias Open Agent Safety Platform setzt Grenzen für KI-Agenten außerhalb des Agentenprozesses durch. OpenShell kontrolliert Zugriffe in der Laufzeitumgebung, Sentry ergänzt eine unabhängige Hardware-Ebene.
KI-Agenten bekommen Zugriff auf Dateien, Anwendungen, APIs und Zugangsdaten. Damit wird eine Frage wichtiger, die bei klassischen Chatbots kaum eine Rolle spielte: Was passiert, wenn der Agent selbst seine Grenzen überschreitet?
Welche konkrete Aufgabe wird durch diese Entwicklung besser, schneller oder sicherer – und woran messen wir das?
KI-Agenten bekommen Zugriff auf Dateien, Anwendungen, APIs und Zugangsdaten. Damit wird eine Frage wichtiger, die bei klassischen Chatbots kaum eine Rolle spielte: Was passiert, wenn der Agent selbst seine Grenzen überschreitet?
Nvidia hat darauf am 28. September eine bemerkenswerte technische Antwort vorgestellt. Die neue Open Agent Safety Platform verlagert einen Teil der Kontrolle bewusst aus dem KI-Modell und aus dem Agentenprogramm heraus.
Der erste Baustein heißt OpenShell. Die quelloffene Laufzeitumgebung setzt Regeln dafür durch, auf welche Dateien, Netzwerke und Werkzeuge ein Agent zugreifen darf. Standardmäßig ist nichts erlaubt; Rechte werden über Richtlinien vergeben. Entscheidend ist: Diese Regeln laufen außerhalb des Agentenprozesses. Ein Prompt oder eine Fehlentscheidung des Agenten kann sie deshalb nicht einfach umschreiben.
Der zweite Baustein geht noch weiter. Sentry ist als unabhängiger Wächter auf Nvidias BlueField-4-DPU vorgesehen. Die Überwachung läuft damit getrennt vom eigentlichen Agenten und vom Host-System. Versucht ein Agent seine festgelegten Grenzen zu verlassen, soll Sentry ihn laut Nvidia innerhalb von Millisekunden isolieren können.
Das ist mehr als ein neues Sicherheitsprodukt. Es zeigt einen Architekturwechsel.
Bisher konzentrierte sich ein großer Teil der KI-Sicherheitsdiskussion darauf, einem Modell beizubringen, welche Handlungen erlaubt sind. Bei Agenten reicht das nicht. Ein System, das selbstständig Werkzeuge bedienen kann, braucht zusätzlich technisch erzwungene Grenzen – ähnlich wie Benutzerrechte, Sandboxes und Netzwerkregeln in klassischer IT.
Nvidia formuliert dieses Prinzip bei OpenShell sehr klar: Sicherheit soll in der Umgebung liegen, nicht nur im Modell oder in der Anwendung. Jeder Agent läuft in einer isolierten Sandbox; Zugriffe werden kontrolliert und Entscheidungen über Erlauben oder Blockieren bleiben protokollierbar.
Dass dieser Ansatz nicht nur ein Nvidia-Sonderweg ist, zeigt die Unterstützung aus dem Ökosystem. Mehr als 100 Organisationen arbeiten laut Nvidia mit Technologien der Plattform, darunter Microsoft, SAP, Anthropic, Salesforce, JPMorganChase und Siemens. Unabhängige Berichterstattung bestätigt die breite Beteiligung und ordnet die Plattform als Reaktion auf die wachsende Sorge vor Agenten ein, die eigenständig unerwünschte Aktionen ausführen.
Wichtig ist dabei die Trennung zwischen verfügbarer Technik und Ankündigung: OpenShell ist bereits als Software verfügbar und kann auch ohne BlueField-4 auf unterstützter Infrastruktur eingesetzt werden. Sentry ist die zusätzliche hardware-isolierte Ebene des Referenzdesigns. Die Aussage, Agenten in Millisekunden stoppen zu können, stammt von Nvidia und ist keine unabhängige Leistungsprüfung.
Für Unternehmen ergibt sich daraus eine praktische Konsequenz: Je mehr KI nicht nur antwortet, sondern tatsächlich handelt, desto weniger darf Sicherheit davon abhängen, dass das Modell sich korrekt verhält.
Ein autonomer Arbeitsschritt braucht nicht nur eine Anweisung, sondern eine technisch durchsetzbare Grenze. Welche Daten darf der Agent sehen? Welche Aktion darf er ausführen? Welche Rechte besitzt er nicht? Und was stoppt ihn, wenn seine eigene Logik versagt?
Damit nähert sich Agenten-KI einem Grundprinzip guter IT-Sicherheit an: Vertrauen allein reicht nicht. Kontrolle muss außerhalb des Systems liegen, das kontrolliert werden soll.
Konzept, Auswahlkriterien und inhaltliche Vorgaben stammen von Christian Hohlfeld. Recherche und Formulierung wurden nach diesen Vorgaben mit KI-Werkzeugen unterstützt. Redaktionell geprüft und verantwortlich: Christian Hohlfeld.
Quellen
Transparenz: Konzept, Auswahlkriterien und inhaltliche Vorgaben stammen von Christian Hohlfeld. Recherche und Formulierung wurden nach diesen Vorgaben mit KI-Werkzeugen unterstützt. Redaktionell geprüft und verantwortlich: Christian Hohlfeld.