Ask HN: あなたが使っているデフォルトモデルは何ですか?その理由は?

Ask HN: What default model do you use and why?

私はほとんどの作業でClaudeを使っていますが、Fableは私にはオーバーキルで、モバイルアプリの初期計画を4つのエージェントで行うだけでMaxプランのセッションクレジットを数分で使い果たしてしまいます(!)。6時間後にタイムアウト期間を待って再開したときにはキャッシュがタイムアウトしていたため、1分未満でセッションの2%を消費しました。Opus 4.8が今の私の定番で、戻る理由が見つかるまで5は避けるつもりです。4.8は私のニーズには「十分」で、素晴らしい価値があります。ほとんどの場合、正しく動作します。私の作業のほとんどはWebとモバイル、主にクラウドバックエンドです。

  1. o_m

    以前はClaudeをメインで使っていたけど、あの文章の書き方がどうしても我慢できない。出力を解読するのに時間を無駄にしすぎている気がする。ライティングルールを追加しても効かないみたいだ。今はGPT 5.6 Terraのhigh fastモードをメインに、それ以外は全部Lunaでやっている。プランニングにはSolを使うことも検討するかもしれない。コーディングにSolやそれ以上の賢いモデルを使うのは耐えられない。最終的にコードベース全体を書き直そうとするからね。

    Claude CodeやCodexのエージェントハーネスも使いたくない。Codexのサブスクの良いところは、Claudeと違って他のハーネスでも使えることだ。俺が知る限り、この制限があるのはAnthropicだけだ。

  2. hgoel

    個人的な用途には、GB10クラスタ上でローカルのQwen3.8-Next-Flash環境を使っている。仕事ではGitHub Copilotで、GPT 5 miniか、タスクの複雑さに応じてOpus/Solを使い分けている。

    以前はClaude 20xプランを払って全部Opusでやっていたけど、今のあの話し方が嫌いだし、最近の出来事(OAIのスクープ、Anthropicのスパイ行為、サードパーティの中国モデルホストが認証情報を盗んで売っていること)で、個人的な用途はローカルAIにかなり傾いた。仕事では自己ホストであっても中国モデルは使えないから、選択の余地はあまりない。

  3. vallerie

    新しいGeminiモデルをAntigravityで使って、なかなかうまくいっている。ただしモデルの使い方は次のどちらかだ:

    - 高機能なオートコンプリートとして(スタブメソッドをいくつか用意して、Xをすべきだから埋めてくれ、という感じ)

    - かなり詳細な計画とテストハーネスを使って、世界をぶっ壊すのが難しくなるように

    3.X Flashファミリーはかなり有能なモデルで、俺にとっての売りはとにかく生の速さだ。Geminiは競合より明らかに速く、だいたい3〜4倍で、それで仕事が早く片付く。

    とはいえOpen Weightsは注視している。DS4 Flashは値上げまでは良かったし、以前の価格で高速かつ量子化なしで提供してくれるプロバイダーを見つけるのは難しい。

  4. montroser

    ここまでの回答を読んでいてつらい。いいか、ウェブとモバイルのタスクの99%以上は、deepseek-v4.1-flashで十分なんだ。めちゃくちゃ速くて、超安くて、かなり有能だ。責任ある振る舞いをして、自分のUI作業を評価するビジョンは一流で、Anthropicのどのモデルよりもずっと尊大でなく、飾り気もない。

    参考までに、速度とコストと知能の比較はこれだ:https://artificialanalysis.ai/models/deepseek-v4-1-flash

    これで複数セッションを回しながら一日中でも一晩中でも作業できて、小売価格で1日2ドルくらいしか使わない。opencode-goなら月10ドルのサブスクに収まるから、実際のコストはそうなる。

  5. karmakaze

    個人的にはQwen3.8-27B(MXFP4量子化 W4A8)をAMD GPU 2枚でローカルホストしている(DeepSeek Harness使用)。250トークン/秒で始まり、128kコンテキストを超えると120まで落ちる。

    仕事では主にOpus 4.8(時々GPTかGemini 3.1 Pro)。Opus 5はおしゃべりで遅いし、Fableは不必要な複雑さへと過剰設計に踏み込みがちだ。

この日のほかの記事

2026-09-12