DeepSeek 推出 V4.1-Flash:更小更快更省钱

DeepSeek v4.1 Flash

DeepSeek 推出 V4.1-Flash:更小更快更省钱

DeepSeek 正式发布了 DeepSeek-V4.1-Flash,这是其新架构家族中最小的模型,原生支持视觉理解。该模型采用非对称架构,拥有 552B 参数的 MoE 结构,但在推理时仅需激活 8B 输入和 16B 输出参数。相比上一代,V4.1-Flash 的 KV cache 仅需 1/4 的 HBM 和 1/8 的 SSD 存储,大幅降低了运行成本。DeepSeek 已将此模型上线 API,并宣布降低价格,同时计划开源权重以支持社区部署。

非对称架构:更多智能,更低成本。

同日更多故事

2026-09-10