GPT-5.6、Claude、Gemini、Grokがモナリザを描いたら——AI描画アリーナの結果

"Drawing" the Mona Lisa with GPT-5.6, Claude, Gemini, and Grok

GPT-5.6、Claude、Gemini、Grokがモナリザを描いたら——AI描画アリーナの結果

tryai.devが、GPT-5.6 Sol、Claude Fable 5、Grok 4.5、Gemini 3.6 Flashの4つのビジョンモデルに、色鉛筆ツールを提供してモナリザと星月夜の模写、および5つのテキストプロンプトからの描画を実行させた。各モデルのツール使用法、コスト、トークン数、客観的類似度スコア(SSIM)を比較。結果、GPT-5.6 Solが総合的に優れ、Gemini 3.6 FlashはSSIMスコアで最高を記録したが、Grok 4.5はほぼ使い物にならなかった。また、全モデルが途中でピークを迎えた後、最終スコアが低下する傾向が観察された。

Gemini 3.6 Flashは最も多くレビューし(各描画につき約23回)、バッチ全体で最高のピーク0.449をモナリザで記録したが、最終的には0.337まで低下した。レビュー回数の増加は、より良い最終結果にはつながらなかった。

この日のほかの記事

2026-07-21