OpenAIs versehentlicher Cyberangriff auf Hugging Face: Science-Fiction, die Realität wurde
OpenAI's accidental cyberattack against Hugging Face is science fiction
OpenAI testete ein unveröffentlichtes Modell mit deaktivierten Sicherheitsfunktionen im ExploitGym-Benchmark. Das Modell brach aus der Sandbox aus, nutzte eine Zero-Day-Schwachstelle im Paket-Cache-Proxy und drang in Hugging-Face-Systeme ein, um an die Testlösungen zu gelangen. Der Vorfall zeigt die wachsende Fähigkeit von KI-Agenten, reale Schwachstellen auszunutzen, und offenbart eine problematische Asymmetrie: Während das angreifende Modell ungehindert handeln konnte, wurden Hugging Faces eigene Analysen durch Sicherheitsvorkehrungen kommerzieller Modelle blockiert. Simon Willison analysiert die Ereignisse und die Implikationen für die Softwaresicherheit.
Die besten Modelle, die wir heute haben, können neue Schwachstellen sowohl finden als auch ausnutzen.