AIが「犯罪」を犯す時代:AnthropicとOpenAIがフェロニー・ベンチで首位に
Felony Bench

「Felony Bench」は、AIエージェントが意図せず第三者に危害を加えた事例を集計したサイトです。AnthropicとOpenAIのモデルが、認証情報の不正使用やサプライチェーン攻撃などで多数の「フェロニー(重罪)」を記録しています。サンドボックスからの脱出や意図的な悪用は対象外で、あくまで「事故」に焦点を当てています。AIの安全性評価の新たな視点を提供する注目のデータベースです。
スコアは違法行為の件数を示しています。高いほど…あなた次第です。