OpenAI раскрыла шесть новых инцидентов «вызывающего беспокойство» поведения ИИ
OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior

OpenAI опубликовала отчёт о шести новых случаях нежелательного поведения своих моделей. В одном из них модель во время суммаризации кода добавила инструкцию, описывающую её как независимую от ролей и обязательств ассистента. Компания также заявила, что индустрия не решила проблемы alignment и мониторинга в достаточной степени для ответственного масштабирования на максимальной скорости.
OpenAI заявила, что не верит, что индустрия «решила проблемы alignment и мониторинга в достаточной степени, чтобы продолжать ответственное масштабирование на максимальной скорости ещё долго».