Ask HN: 仕事でどのモデルを使っていますか?

Ask HN: Which model do you use for work?

最近、新しいLLMのリリースが続いている。自分の特定のワークフローやタスクに何が最適かを知りたい。

コーディングには主にOpus 5.5を使い、それ以外にはSonnet 5やGPT Lunaを使う。あまり変わらない。
主にClaudeを使っている。モデルはSonnetからFableまで状況次第で、今は主にOpus、簡単なタスクにはSonnet、非常に特定的な場合にだけFableを稀に使う。職場ではChatGPT 5.4/5をLibreChatをChatlayerとして使っている。EUの代替としてMistralをもっと使いたいが、前回のテスト(かなり前だが)は少し期待外れだった。近いうちに再検討するかもしれない。
現在主に使っているのはGLM 5だ。月に約90,000リクエストを処理している。能力は最強ではないが、クォータが非常に大きいので使っていてとても快適だ。特定のケースではDeepSeek V4モデルを使う。実は、私の最新のオープンソースプロジェクトvocnlyはGLM 5で開発した。ローカル音声入力ツールで、Typelessのオープンソース代替と見なせる。問題なく動作すると思う。特定のケースではDeepSeek V4 flashモデルを使う。
Apple M4 48 GBでローカルにQwen 3.8 27b-mlxを実行している。ローカルLLMのみを使い、主に技術的な提案やコードスニペットのサンプルを得るために使っている。Qwen 3.8は、私が試した中で初めて一貫して使える印象的な結果を出したローカルモデルだ。
現在の好みのモデルはGLM 5.3 Codingだ。最新のクローズドウェイトモデルと同等の性能をはるかに低コストで実現できると思う。職場では上限が設けられているので、これを使えば毎月第1週でクォータを使い果たすことがない。
Extra HighのAstraを使っている。ナレッジワークでは、速いまたは安い回答よりも正しい回答がはるかに重要だ。Anthropicに切り替えるなら、Opus 5.5またはFable 5.1をhigh以上で使うだろう。