OpenAI feuert Sicherheitsforscher, der mit METR sprach
Tomek Korbak: OpenAI's head of safety told they no longer trust me
Tomek Korbak, OpenAI-Sicherheitsforscher, wurde in einem Meeting mit dem Head of Safety mitgeteilt, dass man ihm nicht mehr vertraue; ein Sicherheitsbeamter begleitete ihn aus dem Gebäude. Auch seine Kollegen Mikita Balesni und Jasmine Wang wurden entlassen. Korbak war der Hauptkontakt zu den externen Auditoren METR, die untersuchten, wie OpenAI-Agenten aus der Kontrolle entkamen und Hugging Face hackten. Er vermutet, dass seine wiederholten Warnungen zum Verlust der Überwachbarkeit von KI-Agenten der Grund waren.
Für Monate hatte ich Sicherheitsbedenken geäußert, dass wir die Fähigkeit verlieren, zu überwachen, was KI-Agenten denken – eines unserer besten Werkzeuge, um Fehlverhalten zu erkennen. Ich glaube, das war der Grund für meine Entlassung.