Codexを1週間Claudeより多用した率直な感想
Quick impressions: A week of using Codex more than Claude

筆者が1週間、AIコーディングアシスタントのCodexをClaudeより多く使った個人的な印象をまとめている。スキルの移植、デバッグ時の慣れ、生成コードのコメント量、アーキテクチャの複雑さ、速度感、JiraやMCPとの連携など、両者の違いを具体的に比較。Claudeは過剰に推測して先回りするのに対し、Codexは指示したことを控えめに実行する「相棒」のような存在だと結論づけている。
Claudeは求められた以上のことを推測して直接実行しようとするのに対し、Codexは指示したことを実行するが、やりすぎない、まるで相棒のような存在だ。
HNでの議論
111- 217
みんながまだ何故かClaudeに固執して魅了されている間に、2026年8月中旬時点でのコーディングモデルとハーネスのSOTAに関する最新情報をお届けします。
Codexは良いです。CLIもデスクトップアプリも、どのプランでも大量に利用できます。
Solも良いです!そして仕事をやり遂げてくれます。非常に長くて思慮深いプロンプトを書くか口述して、Solのxhighまたはmaxを1時間ほど放置して働かせておけばいいです。
ompは素晴らしいハーネスで、Claude CodeやCodexが追加している機能は、おそらくもう数ヶ月前からここにあります。
私が開発者の友人全員に勧めている優れたハーネスですが、他の人にとっては、シンプルさとプラグアンドプレイのオプションであるため、Codexの方が良い選択肢です。
Claudeはまずまずですが、素晴らしいわけではありません。すべてのモデルが何らかの形で制限的になっています。Maxプランでは基本的に無制限のOpusが使えます。Fableは良いですが遅く、ランダムなガードレールが本当に最悪で、そのせいでここ数週間一度も使っていません。
Gemini 3.7はスピードに優れています。誰もがそれを見逃しています。私自身も含めて。
Kimi K3はフロントエンドに最適です。あなたのために犯罪を犯すことを厭わず、かつ実際に成功する可能性がある知性を持っている数少ないモデルの1つです。
DS ProとFlashは速いですが、SolやFable、時々3.7のような、重要なことには実際には使わないでしょう。
GLM 5.3はまだテストしていません。
ローカルモデルも実際に良くなってきているので、 honorable mentionです!残念ながら、5090は今後数ヶ月でますます高価になり続けるでしょう。
この世界にはClaude以外にももっとたくさんあります。そしてそれは…
- mewse-hn
私はClaudeの20ドルのサブスクリプションしか持っていません。先週末、かなり重いタスク(QuakeをRaspberry PiのネイティブGLES 1.0に移植する)をやっていて、Claudeの利用枠を2回使い切りました。その後、OpenCodeでLunaに切り替えて、約0.40ドルのトークンで全部やり終えました。それは印象的でした。
Opus 5.0が4.8と比べてちょっと残念なので、Anthropicは苦境に立たされていると思います。
- agentdev001
仕事の種類によると思いますが、私の仕事ではCodexの方がずっと役に立ちます。正直、主にそれが大幅に速いことに尽きます。おそらく、多くの人が言うように、チャットでもコードでも、言葉の洪水を吐き出さないように調整されているからでしょう(Claudeは巨大なコメントブロックに執着していて、コードを繰り返し変更するために使うと、ほぼ確実に死んだコンテキストノイズになります)。
私は主に、かなり退屈なスタックに対して、非常に執着的で、厳密に範囲を絞り、慎重に考え抜いた小さな変更を、一度に1つのインタラクションで行い、機能とコードを検証しています。自分が何をしているかはわかっていますが、何をやりたくないかもわかっています(キャリアで何十回もやってきたこととまったく同じことです)。
- corytheboyd
私はここで世界のために自分の役割を果たそうとしています。
この投稿は編集が必要です。著者は「Codex」と「Claude」を比較しているのではありません。Codex TUI/CLI(おそらくgpt-5.6-sol)と、Claude Code TUI/CLI(おそらくClaude-Opus-5)を比較しているのです。
Ctrl + F > [5.6, sol, sonnet, opus or fable] で結果はゼロです。
「Claude」は製品ファミリーであり、モデルとハーネス(そしておそらくそれ以上)を含みます。「Claude Code」は、Claude Code TUIと、Claudeデスクトップアプリ内のCCの両方をカバーします。
「Codex」も同じで、Codex TUIまたはChatGPT(旧Codex)デスクトップアプリ内のCodexを指すことができます。(そして、まあ、歴史的には、gpt-5.*-codex。)
「そうそう、Claudeはコーディングに最適だ」と聞くたびに、寿命が1時間縮む思いです。
何かこう、「ねえ、あなた、ニンテンドーを片付けて夕食に来ない?」みたいな。
- stillpointlab
> Codexはスタートレックのデータのようだ
何かの理由で素晴らしい例えです。最初はCodex Solは少し冷たいと感じました。しかし、数週間使ってみると、愛着が湧き、いくつかの個性も見せるようになりました。もう少しビジネスライクなのがありがたいです。Fableは、仕事に集中すべき時に少しフレンドリーすぎることがあります。Codexはもう少し細かいことにこだわることができます。
彼の他の観察のほとんどに同意します。私はすでに、どのモデルが最適かという判断に基づいてタスクを分類し始めています。一般的に、範囲が明確で単純なタスクで、コードを書き出すことが求められる場合はCodexを使います。仕様があまり明確でなく、より広い視野が必要で、モデルにもっと詳細を埋めてほしい場合はFableを使います。
どちらも素晴らしく、一緒に良いチームを形成しています。