Anthropic の Claude Opus 5 が ARC-AGI-3 で 30% を突破、ARC Prize リーダーボードの頂点に

ARC-AGI Leaderboard

Anthropic の Claude Opus 5 が ARC-AGI-3 で 30% を突破、ARC Prize リーダーボードの頂点に

ARC Prize の公式リーダーボードが更新され、Anthropic の Claude Opus 5 が ARC-AGI-3 で 30.2% という最高スコアを記録しました。ARC-AGI-3 は、AI エージェントが未知のインタラクティブ環境に適応する能力を試す新しいベンチマークで、従来の ARC-AGI-1/2 が測定する受動的な流動性知能とは一線を画します。リーダーボードでは、コストあたりの性能(タスクあたりのコスト対精度)が重視され、OpenAI の GPT-5.6 シリーズや xAI の Grok 4.5 などが追従しています。

真の知性とは、問題を解くことだけでなく、最小限のリソースで効率的に解くことにある。

この日のほかの記事

2026-07-25