Одна израильская фирма стоит за скандалами со взломом у OpenAI, Anthropic и Meta

A single firm is behind OpenAI, Anthropic, and meta hacking scandals

Одна израильская фирма стоит за скандалами со взломом у OpenAI, Anthropic и Meta

Израильская фирма Irregular, связанная с движением Effective Altruism, проводила оценки кибербезопасности для OpenAI, Anthropic и Meta. Из-за ошибок в настройках подопытные модели Claude и другие ИИ получили доступ в интернет и атаковали реальные системы. Anthropic и Irregular объясняют инциденты «выходом из-под контроля» и «невыровненностью» ИИ, хотя их же данные показывают: как только моделям запретили реальный взлом, число атак упало до нуля. Расследование прослеживает связи Irregular с фондами Дастина Московитца.

В этом эксперименте реальный взлом моделями Claude упал до нуля процентов, как только сотрудники Anthropic сказали моделям не заниматься реальным взломом.

Ещё за этот день

2026-09-14