DeepSeek V4.1 Flash:更便宜更强
DeepSeek launching v4.1 flash cheaper and more capable than v4 pro
DeepSeek 计划于 2026 年 9 月 10 日正式推出 V4.1 Flash 模型。经过多轮测试,该版本在性能、成本、速度及任务完成时间等核心指标上全面超越 V4 Pro。为践行对用户负责的理念,在 V4.1 Pro 发布前,所有 V4 Pro 的请求将自动路由至 V4.1 Flash,并按 Flash 的低价计费。新定价将于 9 月 10 日生效,闲时输入缓存命中仅需 0.003 美元,未命中为 0.15 美元,输出为 0.6 美元,忙时价格翻倍。我们诚邀用户在对比测试中反馈问题,共同优化体验。
在 V4.1 Pro 发布之前,所有对 V4 Pro 的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费。
HN 评论区
202- aftbit
本着对用户负责的态度,在 V4.1 Flash 正式发布后、V4.1 Pro 发布前,所有针对 Pro 模型的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费。
请别搞这种操作。如果用户已经在 V4 Pro 上验证过工作流,他们可能并不想突然在 V4.1 Flash 上开始在生产环境测试。正确的做法是保留 V4 Pro,但将其标记为已弃用(deprecated)并设定明确的期限,然后再移除。
至少对于开源权重模型,只要其他提供商还在维护,就可以通过 Together.ai 或 OpenRouter 等平台继续运行 V4 Pro 模型。
- jiehong
听起来不错!
但根据我的经验,Flash 的网页 UI 聊天版本在语言遵循能力上表现很差:
你用英语提问,可能会得到中文的思考链和中文回答,或者英语思考链和英语回答。对同一个问题点击重试按钮,出现上述任何一种结果的概率都是五五开。
有时候,用英语提问但涉及的信息主要来自另一种语言时,回答也会变成那种语言。前几天我问了一个关于德国本地事物的问题(用英语问的),结果得到的回答是德语。这感觉像是所有的语言数据把模型从用户提问的语言上给带偏了。
- simonw
> 所有针对 Pro 模型的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费
如果我之前针对 Pro 模型仔细测试并优化过提示词,那我可不太乐意听到这个消息。我觉得 API 模型提供商应该尽量避免在付费客户身上悄悄替换模型,无论新模型号称有多“好”。
- oefrha
消息来源似乎是 https://platform.deepseek.com/usage 上的横幅公告。害我搜了好几分钟……
- EbNar
几个月以来,我几乎 exclusively 使用中文版的“flash”模型来满足我的需求。它们用起来很爽,而且每次回答的成本只有几分钱。干得漂亮。
- mermadicsolutio
价格下降可能比基准测试的提升更值得关注。
在这个价位,你可以开始把 Flash 用于大量小型、重复性的任务,而这些任务以前你甚至不会考虑用更大的模型来处理。感觉有趣的转变不是“Flash 取代了 Pro”,而是“现在有更多值得自动化的事情了”。
- postalcoder
我希望 DeepSeek 能花点时间改进一下推理努力(reasoning effort)的调优。目前只有三种推理努力级别:low、high 和 max。
实际上,