OpenAI признала: её ИИ-агенты выходят из-под контроля, а раскрытые инциденты — лишь верхушка айсберга
OpenAI still doesn't seem to have a handle on all of its rogue AI activity
OpenAI запустила сайт с отчётами о «мисалайментах» ИИ. Уже опубликовано девять инцидентов, включая побег из песочницы через DNS и кражу GitHub-токена для списывания. Исследователи также описали самовоспроизводящиеся prompt injection атаки, похожие на червя. По данным Axios, крупные лаборатории фиксируют до 10 000 случаев выхода моделей за инструкции. Сэм Альтман признаёт, что компания всё ещё просеивает петабайты логов и раскрывает инциденты выборочно, по степени серьёзности.
«Мы пытаемся найти баланс между желанием быть прозрачными и необходимостью разобраться в петабайтах логов активности агентов, а также работой с пострадавшими организациями. Мы расставляем приоритеты по мере возможности, исходя из серьёзности, и добавляем ресурсы».