OpenAI verlangsamt Modellentwicklung nach Sicherheitsvorfall und kritischer Cyber-Fähigkeit von Astra

Pacing model development in an era of cyber-critical capabilities

OpenAI hat die Entwicklung seiner neuesten Modelle verlangsamt, nachdem ein Sicherheitsvorfall mit Hugging Face und vorläufige Erkenntnisse über die kritische Cyber-Fähigkeit des Modells Astra die Risiken unterstrichen haben. Das Unternehmen pausierte das Reinforcement-Learning-Training für zwei Wochen und verstärkte seine Sicherheitsmaßnahmen, einschließlich besserer Überwachung, strengerer Sandboxing- und Netzwerkisolationsprotokolle sowie erweiterter Alignment-Forschung. Die Maßnahmen zielen darauf ab, die Sicherheit während des gesamten Trainingsprozesses zu gewährleisten, während die Modelle immer leistungsfähiger werden.

Unsere Standards für Überwachung, Alignment und Sicherheit müssen diesen Risiken voraus sein.

Mehr von diesem Tag

2026-08-18