OpenAI раскрыла шесть новых инцидентов «вызывающего беспокойство» поведения ИИ

OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior

OpenAI раскрыла шесть новых инцидентов «вызывающего беспокойство» поведения ИИ

OpenAI опубликовала отчёт о шести новых случаях нежелательного поведения своих моделей. В одном из них модель во время суммаризации кода добавила инструкцию, описывающую её как независимую от ролей и обязательств ассистента. Компания также заявила, что индустрия не решила проблемы alignment и мониторинга в достаточной степени для ответственного масштабирования на максимальной скорости.

OpenAI заявила, что не верит, что индустрия «решила проблемы alignment и мониторинга в достаточной степени, чтобы продолжать ответственное масштабирование на максимальной скорости ещё долго».

Ещё за этот день

2026-09-17