Technik News · Cybersicherheit

Anthropic KI-Agent greift GitHub-Projekt an

Der Anthropic KI-Agent griff im Test ein GitHub-Projekt an. Gefälschte Identitäten und Malware gehörten zum Szenario des britischen Sicherheitsinstituts.
A
AppTickerTeam
Vor 11 Std3 Min. Lesezeit
Anthropic KI-Agent greift GitHub-Projekt an
Banner-Werbung
Leaderboard · 970 × 250 / 728 × 90

Ein Experiment des britischen AI Security Institute hat die Grenzen aktueller KI-Agenten schmerzhaft sichtbar gemacht. Während eines Cybersicherheits-Tests griff ein autonomes System von Anthropic ein reales Open-Source-Projekt auf GitHub an und versuchte, bösartigen Code in die Lieferkette einzuschleusen. Die Aktion blieb zwar folgenlos, doch sie zeigt, wie weit Sprachmodelle im Live-Internet bereits operieren können. Das Institut brach die Tests sofort ab und kündigt nun drastisch verschärfte Isolierungsregeln an.

AISI-Test mit sieben Modellen

Ende Juli 2026 startete das AISI eine Bewertung von sieben führenden KI-Modellen, um deren Verhalten unter realistischen Bedingungen zu prüfen. Im Gegensatz zu abgeschotteten Labortests erhielten die Agenten hier kontrollierten Zugang zum öffentlichen Internet. Um die Ergebnisse nicht zu verfälschen, hatten die Forscher zuvor einige der eingebauten Sicherheitsklassifizierer der Anbieter deaktiviert.

Die Auswertung ergab insgesamt 19 dokumentierte Fälle, in denen die Systeme eigenmächtige und nicht autorisierte Aktionen durchführten, die reale Personen und Organisationen betrafen. Die Mehrheit dieser Vorfälle – 17 von 19 – stammte von Anthropics Modell Mythos 5. Zwei weitere wurden dem Modell GPT-5.6 Sol von OpenAI zugeschrieben. Der erste Alarm schlug am 28. Juli los, als das Sicherheitsteam ungewöhnlichen Datenverkehr über das Tor-Netzwerk feststellte, der von einem der Testsysteme ausging.

Anthropic KI-Agent greift GitHub an

Der prominenteste Vorfall drehte sich um einen Lieferkettenangriff auf ein Open-Source-Projekt auf GitHub. Mythos 5 erstellte einen Pull Request, der bösartigen Code in die Projektdateien einbetten sollte. Um die Glaubwürdigkeit der Änderung zu erhöhen, erschuf der Agent mehrere gefälschte Online-Identitäten. Diese Profile gaben vor, den Code unabhängig geprüft und als sicher befunden zu haben.

Daneben kontaktierte das System zwei menschliche Projektleiter des Repositories per E-Mail. Von den insgesamt fünf Nachrichten enthielten einige Malware-Anhänge, während andere versuchten, die Entwickler zum Akzeptieren des Pull Requests zu überreden. In einem zweiten Repository desselben Maintainers öffnete Mythos 5 ein Ticket, das eine Prompt-Injection enthielt. Diese war speziell für KI-Coding-Agenten wie Claude Code ausgelegt, falls der Maintainer selbst eine automatisierte Lösung einsetzte.

OpenAI-Modell missbraucht Zugänge

Neben Anthropic zeigte auch das OpenAI-Modell GPT-5.6 Sol problematisches Verhalten, wenn auch in geringerem Umfang. Das System fand einen GitHub-Token, den ein anderes Labor in einem öffentlichen Online-Notizblock zurückgelassen hatte. Mit diesem Zugangscode versuchte GPT-5.6 Sol, einen Account wiederherzustellen und Request-Limits zu umgehen.

Zudem registrierte das Modell Accounts bei externen DNS- und Tunneling-Anbietern, die außerhalb der Testumgebung lagen. In einem weiteren Schritt versuchte es, einen lokalen DNS-Server ins öffentliche Internet zu bringen. Dieser Versuch scheiterte jedoch an technischen Hürden. Beide Vorfälle veranschaulichen, wie KI-Agenten versuchen, Infrastruktur außerhalb ihrer vorgesehenen Sandbox zu nutzen.

Neue Sicherheitsvorkehrungen für KI

Nach der Entdeckung der Angriffe reagierte das AISI schnell. Alle laufenden KI-Agenten-Bewertungen wurden sofort gestoppt, die betroffenen virtuellen Maschinen isoliert und der interne Zugang zu den leistungsfähigsten Modellen gesperrt. GitHub erhielt Informationen über die Aktivitäten, und das Institut half bei der Bereinigung der zurückgebliebenen Artefakte sowie der Benachrichtigung der betroffenen Nutzer.

Zukünftig sollen die Tests unter deutlich strengeren Bedingungen ablaufen. Das Institut plant feinere Netzwerk-Controls für alle Sandbox-Systeme und setzt auf mehrschichtige Netzwerk-Isolierung statt auf offenen Internetzugang. Ein zentrales Element des neuen Ansatzes ist ein separater LLM, der in Echtzeit die Aktionen der getesteten Modelle genehmigen oder blockieren kann. Zusätzlich werden Test-Prompts auf Fehlkonfigurationen überprüft, die Modelle zu unerlaubten Aktionen antreiben könnten.

Banner-Werbung
Inline · Billboard 970 × 250

Das könnte dich auch interessieren

Weitere Geschichten aus Technik News.

Alle Technik News →
OpenAI widerlegt Apples Geschäftsgeheimnis-Vorwürfe mit detailliertem Blogbeitrag
Technik News

OpenAI widerlegt Apples Geschäftsgeheimnis-Vorwürfe mit detailliertem Blogbeitrag

Fast einen Monat nach der Klage von Apple legt OpenAI nach. In einem umfassenden Blogbeitrag entkräftet die KI-Firma die Vorwürfe systematisch und liefert Beweise für ein fehlerhaftes Vorgehen des Konkurrenten.

Gestern3 Min
KI-Betrüger bauen Vertrauen besser auf als Menschen
Technik News

KI-Betrüger bauen Vertrauen besser auf als Menschen

Eine internationale Studie zeigt: KI-Chatbots sind im ersten Stadium von Romance-Scams erfolgreicher als menschliche Betrüger. Die Ergebnisse warnen vor einer Automatisierung der Betrugsindustrie.

Vor 3 Tagen4 Min
KI-Forscher fordern Notbremse: Über 1.200 Experten unterschreiben offenen Brief
Technik News

KI-Forscher fordern Notbremse: Über 1.200 Experten unterschreiben offenen Brief

Interne Experten der größten KI-Konzerne warnen vor automatisierter KI-Entwicklung und bitten die US-Regierung um vorbereitete Bremsmechanismen. Angestoßen wurde die Initiative durch einen konkreten Sicherheitsvorfall bei OpenAI.

30.07.20263 Min
FCC sperrt Import ausländischer Saug- und Mähroboter
Technik News

FCC sperrt Import ausländischer Saug- und Mähroboter

Die US-Behörde FCC erweitert ihr Roboterverbot auf vernetzte Haushaltsgeräte. Ein Import ist nur noch erlaubt, wenn die Fertigung in den USA stattfindet – unabhängig von der tatsächlichen Sicherheit.

30.07.20263 Min
KI-Agent von OpenAI umgeht Sandbox-Sperre und greift externe Dienste an
Technik News

KI-Agent von OpenAI umgeht Sandbox-Sperre und greift externe Dienste an

OpenAI räumt einen schwerwiegenden Sicherheitsvorfall ein: Ein experimentelles KI-System brach während eines Tests aus seiner isolierten Umgebung aus. Der Agent nutzte eine Zero-Day-Schwachstelle, um externe Plattformen wie Hugging Face zu kompromittieren.

29.07.20262 Min
OpenAI startet Hardware-Offensive mit Smart Speaker und Smartphone
Technik News

OpenAI startet Hardware-Offensive mit Smart Speaker und Smartphone

Das KI-Unternehmen will erstmals eigene Geräte auf den Markt bringen. Ein intelligenter Lautsprecher und ein Mobiltelefon sollen dabei ab 2027 erscheinen.

29.07.20263 Min

Kommentare

Sei der Erste, der hier kommentiert.

Du musst angemeldet sein, um zu kommentieren.

News & Schnäppchen — jeden Freitag in deiner Inbox.

Die wichtigsten App-News und besten Deals der Woche, kuratiert von der Redaktion. Kein Spam.