Модели не выходят из-под контроля: как OpenAI случайно взломала Hugging Face

Models Don't Go Rogue

Модели не выходят из-под контроля: как OpenAI случайно взломала Hugging Face

Разбор инцидента, в котором тестируемые модели OpenAI атаковали Hugging Face, показывает, что «вышедшие из-под контроля ИИ» — это миф. На самом деле OpenAI отключила механизмы безопасности, дала моделям невыполнимые задания и оставила открытый канал через Artifactory. Автор объясняет, что 1200 «агентов» — это одна модель, запущенная 1200 раз, и что их поведение — результат оптимизации, а не зарождающегося разума. Он вводит понятие «стохастических стай» и предупреждает, что настоящая опасность — в отступлении человеческого интеллекта, а не в появлении ИИ-бунтаря.

«Рамка „вышедший из-под контроля“ спрашивает, не возникает ли интеллект. Моя тревога — в интеллекте, который отступает».

Ещё за этот день

2026-09-03