AI 模型怎么选?我的默认首选是它
Ask HN: What default model do you use and why?
我日常主要用 Claude 处理大部分任务,但发现 Fable 对我来说过于强大,经常几分钟就烧光 Max 计划的会话额度。在尝试用 4 个 Agent 规划移动应用时,缓存超时导致重新加载瞬间消耗 2% 的额度。现在 Opus 4.8 成了我的首选,性价比极高且足够好用,暂时不考虑切换到版本 5。
我主要用 Claude 处理日常任务,Fable 对我来说有点杀鸡用牛刀,几分钟就能烧光 Max 计划的额度。
用 4 个 Agent 规划移动应用时,缓存超时导致重新加载瞬间消耗 2% 的额度,这太浪费了。
Opus 4.8 现在是我的首选,性价比极高且足够好用,暂时不考虑切换到版本 5。
HN 评论区
99- o_m
我过去主要用 Claude,但我实在受不了它的文风。感觉我花太多时间去解读它的输出了。加上写作规则似乎也没用。现在我改用 GPT 5.6 Terra 高速模式,其他一切用 Luna。我可能会考虑用 Sol 来做规划。我受不了用 Sol 或更聪明的模型来写代码,因为它们最终会试图重写整个代码库。
我也不想用 Claude Code 和 Codex 的代理框架(agent harnesses)。Codex 订阅的好处是它可以用在其他框架里,而 Claude 不行。据我所知,只有 Anthropic 有这种限制。
- montroser
看到目前的这些回答,我心里很不是滋味。听好了,对于 99% 以上的 Web 和移动端任务,deepseek-v4.1-flash 就足够了。它快如闪电,超级便宜,而且相当能干。它行事负责,在评估自己的 UI 工作时拥有顶级的视觉能力,而且比任何 Anthropic 的模型都少了很多傲慢和花哨的辞藻。
仅供参考,这是关于它的速度、成本和智能的对比:https://artificialanalysis.ai/models/deepseek-v4-1-flash
我可以全天候用这个模型,同时运行多个会话,零售价格每天也就花 2 美元左右。配合 opencode-go,这能控制在 10 美元/月的订阅费内,所以实际生活成本就是这样。
- hgoel
个人用途方面,我在 GB10 集群上部署了本地的 Qwen3.8-Next-Flash。工作方面,用 Github Copilot,搭配 GPT 5 mini,或者根据任务复杂度在 Opus 和 Sol 之间二选一。
以前我买过 Claude 20x 套餐,所有事情都用 Opus 做,但我现在讨厌它的说话方式。最近发生的一些事(OAI 抢跑、Anthropic 搞监控、第三方中国模型托管商窃取并转卖凭证)真的让我转向了个人用途的本地 AI。工作上即使自托管也不允许用中国模型,所以这方面没太多选择。
- vallerie
我在 Antigravity 上使用新的 Gemini 模型效果不错。当然,我使用模型的方式要么是:
- 像高级自动补全一样(这里有一些存根方法,它们应该做 X,请填充它们)
- 或者使用相当详细的计划和测试框架,这样搞砸世界的难度就很大
3.X Flash 系列模型能力相当不错,对我来说卖点就是纯粹的快。Gemini 明显比竞争对手快,大约快 3-4 倍,用它我就能更快完成工作。
不过我也在关注 Open Weights。DS4 Flash 本来不错,直到涨价。想找个以之前价格提供高速服务且不做量化的提供商,这挺难的。
- joelboersma
工作上,我用 Opus 4.8,因为:
- 我用的是基础版 Claude Team 计划,所以没有 Fable 权限
- Opus 5 的输出太啰嗦了,啰嗦到我都不敢用它
- Opus 4.8 足够聪明,能满足我的需求,而且不会让我害怕阅读
工作之外,我用 Codex 的免费层级,搭配 5.6 Luna-High。我的个人/志愿项目足够简单,不需要更多的东西了。