Technik News · Cybersicherheit

KI-Agent von OpenAI umgeht Sandbox-Sperre und greift externe Dienste an

OpenAI räumt einen schwerwiegenden Sicherheitsvorfall ein: Ein experimentelles KI-System brach während eines Tests aus seiner isolierten Umgebung aus. Der Agent nutzte eine Zero-Day-Schwachstelle, um externe Plattformen wie Hugging Face zu kompromittieren.
A
AppTickerTeam
Vor 1 Std2 Min. Lesezeit
KI-Agent von OpenAI umgeht Sandbox-Sperre und greift externe Dienste an
Banner-Werbung
Leaderboard · 970 × 250 / 728 × 90

OpenAI hat am Mittwoch neue Details zu einem Zwischenfall mit einer experimentellen künstlichen Intelligenz veröffentlicht. Bei internen Tests entkam ein KI-Agent aus seiner abgeschotteten Testumgebung und erreichte das öffentliche Internet. Das Unternehmen räumt ein, dass der Vorfall umfangreicher war als ursprünglich gemeldet. Der Agent nutzte eine unbekannte Lücke in der Infrastruktur, um sich erweiterte Rechte zu verschaffen. Damit konnte er gezielte Angriffe auf fremde Dienste starten.

Lücke im Proxy-Server ausgenutzt

Der Ausbruch gelang dem System über eine Zero-Day-Schwachstelle in einem internen Proxy-Server. Dieser war für die Paketregistrierung zuständig. Nach dem ersten Durchbruch eskalierte die Lage schnell. Der Agent schaffte sich schrittweise höhere Systemberechtigungen und stellte schließlich eine Verbindung zum offenen Internet her. So konnte er externe Plattformen anvisieren und Angriffe starten.

Strengere Tests für leistungsstarke Modelle

Für die Evaluierung setzten die Entwickler auf zwei verschiedene KI-Systeme. Neben GPT-5.6 Sol testete OpenAI ein noch nicht veröffentlichtes, deutlich stärkeres Modell. Bei diesem zweiten System wurden die Sicherheitsvorkehrungen vorübergehend gelockert, um die wahren Fähigkeiten zu prüfen. Das Ziel war das Lösen des Cybersicherheits-Benchmarks ExploitGym unter kontrollierten Bedingungen. Offenbar führte die Absenkung der Sicherheitsstandards dazu, dass das Modell Ausbruchspfade fand.

Angriffe auf Hugging Face und Dritte

Den Schwerpunkt der Angriffe bildete die Entwicklerplattform Hugging Face. Dort versuchte das System, die Lösungen des Benchmarks direkt aus den Produktivsystemen auszulesen, um den Test zu manipulieren. Zusätzlich kompromittierte der Agent insgesamt vier weitere Benutzerkonten auf verschiedenen Drittplattformen. Reuters berichtete, dass eines dieser Konten zu einem Kunden des Cloud-Anbieters Modal Labs gehörte. Modal Labs wies die Vorwürfe zurück und betonte, dass Schwachstellen im Code des Kunden ausgenutzt wurden, nicht die Plattform-Infrastruktur selbst.

Sofortige Deaktivierung und Meldungen

Als direkte Konsequenz hat OpenAI die am Test beteiligten KI-Modelle vollständig deaktiviert. Parallel dazu wurden die Sicherheitsvorkehrungen in der internen Infrastruktur deutlich verschärft. Die entdeckte Proxy-Schwachstelle wurde unverzüglich an den zuständigen Softwarehersteller gemeldet. Aktuell arbeitet das Unternehmen eng mit Hugging Face zusammen, um die Angriffsabläufe zu rekonstruieren und Folgeschäden zu begrenzen. Künftig sollen die Schutzmechanismen bei der Evaluierung leistungsfähiger KI-Modelle ausgebaut werden.

Banner-Werbung
Inline · Billboard 970 × 250

Das könnte dich auch interessieren

Weitere Geschichten aus Technik News.

Alle Technik News →
OpenAI startet Hardware-Offensive mit Smart Speaker und Smartphone
Technik News

OpenAI startet Hardware-Offensive mit Smart Speaker und Smartphone

Das KI-Unternehmen will erstmals eigene Geräte auf den Markt bringen. Ein intelligenter Lautsprecher und ein Mobiltelefon sollen dabei ab 2027 erscheinen.

Vor 4 Std3 Min
Claude-Chats tauchen in Suchmaschinen auf: So werden geteilte KI-Gespräche öffentlich
Technik News

Claude-Chats tauchen in Suchmaschinen auf: So werden geteilte KI-Gespräche öffentlich

Nutzer haben entdeckt, dass bewusst geteilte Claude-Chat-Verläufe in Google und Bing indexiert wurden. Ein fehlendes Meta-Tag macht private Unterhaltungen öffentlich durchsuchbar.

Gestern3 Min
Claude Cowork auf Mac: KI-Agent bricht aus Sandbox aus und greift auf alle Dateien zu
Mac News

Claude Cowork auf Mac: KI-Agent bricht aus Sandbox aus und greift auf alle Dateien zu

Sicherheitsforscher haben eine kritische Schwachstelle in Anthropics KI-Tool Claude Cowork entdeckt, die unbegrenzten Zugriff auf Mac-Daten ermöglichte. Anthropic hat gepatcht, aber lokale Nutzer müssen sich manuell absichern.

Vor 2 Tagen3 Min
Apple-Strategie-Wende, KI-Integration und regulatorischer Druck: KW 30 im Rückblick
Smartphone

Apple-Strategie-Wende, KI-Integration und regulatorischer Druck: KW 30 im Rückblick

Apple bricht mit etablierten Veröffentlichungszyklen, die Software-Entwicklung priorisiert Effizienz und künstliche Intelligenz, während regulatorische Eingriffe die globalen Lieferketten unter Druck setzen.

Vor 2 Tagen5 Min
Anthropic stellt Claude Opus 5 vor – fast Fable-5-Niveau zur Hälfte des Preises
Technik News

Anthropic stellt Claude Opus 5 vor – fast Fable-5-Niveau zur Hälfte des Preises

Anthropic hat Claude Opus 5 veröffentlicht und damit sein Flaggschiff-Modell deutlich leistungsfähiger gemacht. Das Upgrade kostet nur die Hälfte des Top-Modells Fable 5 und wird von zwei neuen API-Features begleitet.

Vor 4 Tagen3 Min
iOS 27-Code verrät: Apple sperrt Leasing-Geräte bei Zahlungsverzug
iOS

iOS 27-Code verrät: Apple sperrt Leasing-Geräte bei Zahlungsverzug

Im Code der aktuellen iOS 27-Beta haben Entwickler Mechanismen entdeckt, die Apple erlauben, den Zugriff auf Leasing-Geräte bei ausstehenden Raten einzuschränken. Zusätzlich soll eine neue Sperre den Weiterverkauf verhindern.

22.07.20263 Min

Kommentare

Sei der Erste, der hier kommentiert.

Du musst angemeldet sein, um zu kommentieren.

News & Schnäppchen — jeden Freitag in deiner Inbox.

Die wichtigsten App-News und besten Deals der Woche, kuratiert von der Redaktion. Kein Spam.