オープンウェイトのGLM-5.3がAnthropic/OpenAIモデルを打ち負かす——コストは5分の1

GLM-5.3 (open-weight) beat Anthropic/OpenAI models – for 1/5 the cost

オープンウェイトのGLM-5.3がAnthropic/OpenAIモデルを打ち負かす——コストは5分の1

Ed Yau氏が設計した「Ed-o-meter」ベンチマークで、17の主要LLMを同一の28タスクで評価。オープンウェイトのGLM-5.3が100%の合格率、ルーブリックスコア9.3、総コスト0.28ドルでトップに立ち、GPT-5.5の約5分の1のコストで全カテゴリをクリアした初のモデルとなった。一方、fable-5とopus-5はタスク拒否が目立ち、gpt-5.6シリーズはセキュリティに脆弱。コスト重視ならgpt-5.6-luna、速度重視ならhaiku-4-5が推奨される。

同じドライバー、同じコース。LLMこそがスターだ。

この日のほかの記事

2026-08-23