工作流大比拼:你都在用哪个模型?
Ask HN: Which model do you use for work?
最近一波新的 LLM 发布让人眼花缭乱,我很想知道大家在各自的工作流和任务中,到底觉得哪个模型最好用?希望能了解大家的实战经验和偏好。
我通常用 Opus 5.5 处理代码,其他任务则用 Sonnet 5 或 GPT Luna,具体选哪个其实没那么重要。
主力是 GLM 5,虽然能力不是最强,但每月 9 万次的配额让我用得非常爽;特定场景下我会切换到 DeepSeek V4。
我只在 Apple M4 上本地运行 Qwen 3.8 27b-mlx,这是首个能持续给出可用且令人印象深刻结果的本地模型。
对于知识型工作,正确答案远比快速或廉价重要,所以我首选 Astra Extra High,或者 Anthropic 的 Opus 5.5 和 Fable 5.1。
作为负责安全关键代码的工程师,理解比速度更重要。GPT 系列输出比我更容易理解,所以我坚持用 GPT 5.6 Sol,尽管 Opus 和 Fable 在工程上更出色。
为了控制在每月 100 美元预算内,80% 的任务用 Luna High;偶尔用 Sol 6 High 或 Astro xHigh,还会让 Chat 模型帮我对 Luna 生成的代码做审查。