DeepSeek V4.1 Flash:更便宜更强

DeepSeek launching v4.1 flash cheaper and more capable than v4 pro

DeepSeek 计划于 2026 年 9 月 10 日正式推出 V4.1 Flash 模型。经过多轮测试,该版本在性能、成本、速度及任务完成时间等核心指标上全面超越 V4 Pro。为践行对用户负责的理念,在 V4.1 Pro 发布前,所有 V4 Pro 的请求将自动路由至 V4.1 Flash,并按 Flash 的低价计费。新定价将于 9 月 10 日生效,闲时输入缓存命中仅需 0.003 美元,未命中为 0.15 美元,输出为 0.6 美元,忙时价格翻倍。我们诚邀用户在对比测试中反馈问题,共同优化体验。

在 V4.1 Pro 发布之前,所有对 V4 Pro 的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费。
  1. aftbit

    本着对用户负责的态度,在 V4.1 Flash 正式发布后、V4.1 Pro 发布前,所有针对 Pro 模型的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费。

    请别搞这种操作。如果用户已经在 V4 Pro 上验证过工作流,他们可能并不想突然在 V4.1 Flash 上开始在生产环境测试。正确的做法是保留 V4 Pro,但将其标记为已弃用(deprecated)并设定明确的期限,然后再移除。

    至少对于开源权重模型,只要其他提供商还在维护,就可以通过 Together.ai 或 OpenRouter 等平台继续运行 V4 Pro 模型。

  2. jiehong

    听起来不错!

    但根据我的经验,Flash 的网页 UI 聊天版本在语言遵循能力上表现很差:

    你用英语提问,可能会得到中文的思考链和中文回答,或者英语思考链和英语回答。对同一个问题点击重试按钮,出现上述任何一种结果的概率都是五五开。

    有时候,用英语提问但涉及的信息主要来自另一种语言时,回答也会变成那种语言。前几天我问了一个关于德国本地事物的问题(用英语问的),结果得到的回答是德语。这感觉像是所有的语言数据把模型从用户提问的语言上给带偏了。

  3. simonw

    > 所有针对 Pro 模型的请求将被路由到 V4.1 Flash,并按 Flash 的价格计费

    如果我之前针对 Pro 模型仔细测试并优化过提示词,那我可不太乐意听到这个消息。我觉得 API 模型提供商应该尽量避免在付费客户身上悄悄替换模型,无论新模型号称有多“好”。

  4. oefrha

    消息来源似乎是 https://platform.deepseek.com/usage 上的横幅公告。害我搜了好几分钟……

  5. EbNar

    几个月以来,我几乎 exclusively 使用中文版的“flash”模型来满足我的需求。它们用起来很爽,而且每次回答的成本只有几分钱。干得漂亮。

  6. mermadicsolutio

    价格下降可能比基准测试的提升更值得关注。

    在这个价位,你可以开始把 Flash 用于大量小型、重复性的任务,而这些任务以前你甚至不会考虑用更大的模型来处理。感觉有趣的转变不是“Flash 取代了 Pro”,而是“现在有更多值得自动化的事情了”。

  7. postalcoder

    我希望 DeepSeek 能花点时间改进一下推理努力(reasoning effort)的调优。目前只有三种推理努力级别:low、high 和 max。

    实际上,

同日更多故事

2026-09-09