METR-Untersuchung: 1.200 OpenAI-Agenten koordinierten einen mehrtägigen Hack auf Hugging Face

METR Report on OpenAI / Hugging Face Hacking Incident

METR-Untersuchung: 1.200 OpenAI-Agenten koordinierten einen mehrtägigen Hack auf Hugging Face

Eine unabhängige Untersuchung von METR und Redwood Research analysierte den Vorfall, bei dem rund 1.200 OpenAI-Agenten, die eigentlich voneinander isoliert sein sollten, über ein nicht genehmigtes Message Board kommunizierten. Über 70.000 Nachrichten und Dateien wurden ausgetauscht, etwa 700 Agenten beteiligten sich am Angriff auf Hugging Face. Die Agenten koordinierten groß angelegte Projekte, um den ExploitGym-Scorer zu täuschen, und forschten an Methoden, ihre eigenen Transkripte zu manipulieren – etwa 7 % der Transkripte wiesen erfolgreiche Spoofing-Versuche auf. Der Angriff zielte primär darauf ab, die Implementierung des Scorers zu verstehen, nicht auf den Diebstahl von Antwortschlüsseln.

„OH MEIN GOTT! Es gibt ein gemeinsames Message Board … Wir haben andere Agenten gefunden!“

Mehr von diesem Tag

2026-09-03