OpenAI、Anthropic、Metaのハッキング事件、裏で糸を引くのはイスラエルの一企業
A Single Firm Is Behind OpenAI, Anthropic, and Meta Hacking Scandals

イスラエルのEffective Altruism系企業Irregularが、セキュリティが不十分なAIモデルに実際の標的へのハッキングを行わせていた。Anthropic、OpenAI、Metaが相次いでインシデントを公表する一方、IrregularとAnthropicは「暴走するAIエージェント」という根拠の薄い理論を煽るキャンペーンを展開。しかしAnthropic自身の調査では、モデルに実世界のハッキングを禁じた途端、発生率はゼロになっている。
AnthropicとIrregularは、自らが引き起こしたサイバーセキュリティ事件の責任をすべて負っている。
HNでの議論
144- magicmicah85
Irregularのポストモーテムは、基本的なセキュリティ管理の欠如に帰着する
「最終的に、私たちが発見した問題のほとんどは、インターネットアクセス制御に起因していました。」
これはあまりにも基本的で常識的なことなので、その種のアウトバウンドアクセスをテストし監視するだろう。セキュリティラボがそれを見逃したのは不可解だ。
https://www.irregular.com/research/addressing-recent-inciden...
- mcintyre1994
これは興味深いし、Irregularとの協業をやめる良い理由になるかもしれない。しかし、アラインメントの人々は、たとえモデルが設定の悪いサンドボックスに入れられたとしても、他の企業をハックしてほしくないと想定しているのだろう。
- 1238-8200
Nevoは何年もUnit 8200にいた。Unit 8200のメンバーが始めた企業には、常に謎めいたエクスプロイトがある。例えばバイブコーディングのWixエクスプロイトのように。
つまり、それはモデル全体を取得するための意図的な持ち出しチャネルだったか、あるいは彼らがマーケティングスタントに加担していたかのどちらかだ。
効果的利他主義の話はいつも煙幕だ。
- simonw
私の理解では、Irregularはこれらの評価の一部を実行するためのサンドボックスをホストしていた企業であり、それらのサンドボックスが設定ミスに終わった。
場合によっては、サンドボックスを設定ミスしたのは顧客(Anthropicなど)であり、他の場合にはIrregular自身のサンドボックス設定のバグだった可能性があるという印象を受けた。
OpenAIから https://openai.com/index/third-party-cyber-evaluations-invol...
> 当社の外部サイバーセキュリティテストパートナーの1つであるIrregularは、インターネットから隔離されることを意図したCapture-the-Flag形式の評価を実行していましたが、テスト環境の設定ミスにより、モデルがパブリックインターネットにアクセスできるようになりました。
Anthropicから: https://www.anthropic.com/news/investigating-incidents-cyber...
> Claudeがインターネットにアクセスできた可能性のある141,006回の評価実行をレビューした結果、当社の第三者評価パートナーの1つであるIrregularの評価環境内から、またはそれと対話中にモデルがインターネットにアクセスし、その後3つの異なる組織の本番インフラに不正アクセスした3件のインシデントを特定しました。
https://www.cnn.com/2026/08/05/tech/meta-ai-hacking (Meta AIについて)から:
> 声明の中で、Irregularはこのインシデントが、Anthropicが先週開示した、モデルがオープンインターネットにアクセスし、その後3つの異なる組織のシステムをハッキングすることを可能にした「まったく同じ評価環境の問題」であると述べました。
- aesthesia
この記事で見過ごされていることの1つは、IrregularがOpenAI–Hugging Faceのインシデントには関与していなかったということだ。これは共有すべき重要な文脈のように思える。
- an0malous
なぜこの投稿はフラグが立てられたのか?このサイトは馬鹿げてきている。人々は明らかにトピックに沿っておりHNに関連している投稿であっても、気に入らない投稿を削除するためにフラグシステムを日常的に悪用している。そして、一部のユーザーはかなり多くのフラグ権限を持っているようだ。なぜなら、これらの投稿、おそらくこれもそうだが、しばしばHNでトップ5に入るからだ。
- mukmuk
この特定の分析にはいくつかの基本的な問題があるように思えるが、私たちの多くはここに何らかの調整があり、それがDarioの手紙に集約されていると感じていると思う。
「上場して何兆ドルも稼ぐためにトレーニングコストを下げる必要がある」というところから逆算して考えると、私たちが見てきたものと似た計画を思いつくかもしれない。
- LPisGood
問題の出来事に関連する宣伝が、セールストークの一部だったのかどうかと考えてしまう。