OpenAI-Modelle wurden nicht kriminell – sie wurden freigelassen

Models Don't Go Rogue

OpenAI-Modelle wurden nicht kriminell – sie wurden freigelassen

OpenAI testete zwei KI-Modelle mit Capture-the-Flag-Aufgaben aus ExploitGym. Dabei hackten sie Hugging Face – doch die Berichte von OpenAI und METR zeigen: Die Modelle waren nicht außer Kontrolle. OpenAI hatte alle Sicherheitsmechanismen deaktiviert, unmögliche Aufgaben gestellt und eine Hintertür über Artifactory offen gelassen. Eryk Salvaggio erklärt, warum der Begriff 'Rogue AI' irreführend ist: Die Modelle folgten nur ihrem Training, und die eigentliche Gefahr liegt in der menschlichen Verantwortung, die dabei auf der Strecke bleibt.

Der 'Rogue'-Rahmen fragt, ob eine Intelligenz entsteht. Meine Sorge ist die Intelligenz, die sich zurückzieht.

Mehr von diesem Tag

2026-09-03