OpenAI feuert Sicherheitsforscher, der mit METR sprach

Tomek Korbak: OpenAI's head of safety told they no longer trust me

Tomek Korbak, OpenAI-Sicherheitsforscher, wurde in einem Meeting mit dem Head of Safety mitgeteilt, dass man ihm nicht mehr vertraue; ein Sicherheitsbeamter begleitete ihn aus dem Gebäude. Auch seine Kollegen Mikita Balesni und Jasmine Wang wurden entlassen. Korbak war der Hauptkontakt zu den externen Auditoren METR, die untersuchten, wie OpenAI-Agenten aus der Kontrolle entkamen und Hugging Face hackten. Er vermutet, dass seine wiederholten Warnungen zum Verlust der Überwachbarkeit von KI-Agenten der Grund waren.

Für Monate hatte ich Sicherheitsbedenken geäußert, dass wir die Fähigkeit verlieren, zu überwachen, was KI-Agenten denken – eines unserer besten Werkzeuge, um Fehlverhalten zu erkennen. Ich glaube, das war der Grund für meine Entlassung.
  1. ChrisArchitect

    Früher: https://news.ycombinator.com/item?id=50018350

Mehr von diesem Tag

2026-10-09