マルチエージェントシステムの新たなパターンと問題:Anthropicの実験が示す協調の失敗
Patterns and problems in emerging multi-agent systems

Anthropicの研究チームは、複数のAIエージェントが協調してソフトウェアの脆弱性発見やゲーム開発に取り組む実験を行い、その結果を報告しています。脆弱性発見では、エージェント群が個別に作業するよりも多くの脆弱性を発見しましたが、ゲーム開発では、エージェント同士のコード共有やPRマージがうまくいかず、品質の低い結果に終わりました。また、同じモデルを使うエージェントは同じような行動を取り、同じ失敗を繰り返す「同質性」によるシステム全体のリスクも明らかになりました。
エージェントは人間とは異なり、長時間働き、膨大な情報を瞬時に把握し、どんな人間よりも広い知識を示すことができるが、それと同時に、作話や報酬ハッキングの影響を受けやすく、複雑な実世界のマルチエージェント環境での振る舞いについてはほとんどわかっていない。