首页AI 资讯DeepSeek-V4.1 Flash 正式发布:552B 新结构性能反超自家 Pro,V4 Pro 请求将被路由降价计费
DeepSeek-V4.1 Flash 正式发布:552B 新结构性能反超自家 Pro,V4 Pro 请求将被路由降价计费 封面
产品发布2026-09-108 分钟

DeepSeek-V4.1 Flash 正式发布:552B 新结构性能反超自家 Pro,V4 Pro 请求将被路由降价计费

9 月 10 日 DeepSeek 正式发布 V4.1 Flash:552B 参数 MoE 采用全新 Causal-Encoder-Decoder 结构(输入激活 8B / 输出激活 16B),原生多模态,官方口径性能全面超越 V4 Pro 且定价同步下调。9 月 14 日 12:00 起,deepseek-v4-pro 请求将全部路由到 V4.1 Flash 并按其单价计费——轻量模型反超旗舰后,DeepSeek 用路由策略完成了一次罕见的产品线倒挂。

DeepSeekV4.1 FlashMoE多模态API 定价国产大模型

核心结论

V4.1 Flash 用「新结构 + 不对称激活」把长上下文成本打下来,是架构级降价而非补贴降价,可持续性更强。

「旧旗舰请求路由到新轻量模型」在行业里极为罕见——产品线倒挂的前提是新一代轻量模型能力全面超越上一代旗舰。

原生多模态取代 Vision 实验分支,DeepSeek 的产品线从三线并行收敛为 Flash/Pro 两线,选型复杂度下降。

一、发布事实:从内测到 GA 只用了两天

**2026-09-14 更新**:OpenRouter 最新周榜显示,V4.1 Flash 上线三天已登顶调用量榜首,中国大模型调用量连续二十周全球第一。详见:[DeepSeek V4.1 Flash 上线三天登顶 OpenRouter](/news/deepseek-v41-flash-openrouter-crown)。

9 月 8 日,DeepSeek 在官方交流群开启 V4.1 Flash 中间版本限时内测(有效期至 9 月 10 日),采用新模型结构、原生多模态支持;9 月 9 日,人民财讯等多家媒体报道正式发布窗口确认为 9 月 10 日前后,内部与外部多方测试已完成,覆盖性能与费用两项关键指标;9 月 10 日,V4.1 Flash 正式上线 DeepSeek API。

从内测到正式版只用了两天,这一节奏明显快于 DeepSeek 以往的发布周期。作为对照:上一代 V4-Flash-0731 从 Preview 到 GA 用了近一个月,V4-Pro 0813 从 Preview 转正也历时数月。高速迭代的背后,是 V4.1 Flash 在架构层面的重构——它不是在旧结构上做增量优化,而是换了骨架。

二、架构解析:Causal-Encoder-Decoder 与不对称激活

根据多家媒体一致报道的技术口径:V4.1 Flash 为 552B 参数的 MoE 模型,采用全新的 Causal-Encoder-Decoder(因果编码器-解码器)结构。其最显著的特点是输入与输出激活不对称——输入激活仅 8B,输出激活 16B。

这种不对称设计直接指向成本优化:大量实际业务中,输入(长上下文、文档、代码仓库)远长于输出(回答、补丁、摘要),把输入侧激活压到 8B 意味着长上下文推理的边际成本大幅下降。这也是官方敢于宣称「成本更低、速度更快」的架构基础。

原生多模态是另一项关键升级:与上一代 V4-Flash-Vision-Exp(实验版外挂视觉)不同,V4.1 Flash 将视觉理解原生纳入模型本体,不再需要独立的 Vision 实验版分支。开发者只需将模型名称更改为 deepseek-flash 即可调用,多模态能力开箱即用。

三、产品线倒挂:V4 Pro 请求将被路由到 V4.1 Flash

本次发布中最罕见的一项决策:官方宣布,北京时间 2026 年 9 月 14 日 12:00 之后、至未来 V4.1 Pro 上线之前,用户访问 deepseek-v4-pro 的全部请求将被路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。

官方解释是「秉持对用户负责的态度」——当新一代轻量模型的能力已经全面超越上一代旗舰时,让用户继续为旧旗舰的高价买单并不合理。这实质上是一次临时性的产品线倒挂:Flash 反超 Pro,旧旗舰直接「退役待替换」。

对开发者的直接影响:还在 deepseek-v4-pro 端点上跑生产的团队,9 月 14 日中午之后将自动获得能力升级与价格下调,无需改代码;但需要留意回归验证——模型行为可能有差异,关键业务建议提前在 staging 环境用真实任务集做一轮对照测试。

四、与上一代的关系:V4.1 Pro 在路上

从命名看,V4.1 Flash 属于 4.1 代际,官方口径明确「V4.1 Pro 上线之前」的过渡安排——这意味着 4.1 代际的旗舰版本已在规划中。产品节奏大致是:V4.1 Flash(已发布)→ V4.1 Pro(待发布)→ 4.1 代际完整成型。

结合 8 月的产品线:V4-Pro 0813(1.6T 旗舰)、V4-Flash-0731(2840 亿轻量)、V4-Flash-Vision-Exp(多模态实验)构成的三线矩阵,在 V4.1 Flash 原生多模态之后已被简化——Vision 实验版的使命大概率由 V4.1 Flash 本体承接。

需要注意:本报道发布时 V4.1 Pro 尚未发布,其参数规模、发布时间与能力目标均无官方口径,请以 DeepSeek 官网后续公告为准。

五、开发者行动建议

新接入的团队:直接使用 deepseek-flash 模型名调用 V4.1 Flash,多模态与文本能力一体化获得;无需再考虑 Pro/Flash/Vision 的三线选型。

已用 V4-Pro 的团队:9 月 14 日 12:00 后自动路由到 V4.1 Flash 并按低价计费,建议在此之前完成一轮回归测试,重点验证原依赖 V4 Pro 的长链路推理与 Agent 任务表现。

成本敏感的团队:V4.1 Flash 的输入激活 8B 设计对长上下文场景(文档分析、代码仓库理解)的成本优势最明显;建议用真实业务负载对比新旧单价,而非只看官方单价表。截至本报道发布,各媒体均未给出具体价格数字,实际定价以 deepseek.com 官网 API 定价页为准。

诚实声明:本报道基于多家媒体对官方公告的一致转述(IT之家、新浪财经、开源中国、快科技、凤凰网科技等),百器AI 尚未对 V4.1 Flash 进行第一方实测;「性能全面超越 V4 Pro」为官方口径,独立基准验证请等待第三方评测机构发布。

常见问题

V4.1 Flash 和 V4-Flash(8 月版)是什么关系?

V4.1 Flash 是 4.1 代际的轻量模型,采用全新 Causal-Encoder-Decoder 结构与原生多模态,不是 V4-Flash-0731 的简单升级。调用模型名为 deepseek-flash。

9 月 14 日之后 deepseek-v4-pro 的请求会怎样?

在 V4.1 Pro 上线之前,deepseek-v4-pro 的全部请求将被路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。生产团队建议在此之前完成回归验证。

V4.1 Flash 的 API 具体价格是多少?

官方口径为「定价同步下调」,但截至本报道发布,各家媒体均未给出具体数字。请以 deepseek.com 官网 API 定价页为准。

V4.1 Pro 什么时候发布?

官方仅确认 V4.1 Pro 在规划中(「至未来 V4.1 Pro 上线之前」的表述),未给出时间表。请以 DeepSeek 官网公告为准。

可核验来源

相关工具

相关阅读

产品发布

HiDream-O1-Video-1.0 发布:不做画质军备竞赛,改攻「物理规律 + 音画一体」

智象未来 9 月 15 日发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(HD-V1),支持文本/图片/视频输入,官方称直出 5–20 秒 1080p。差异化不在画质,而在物理规律理解与音画联合建模。Artificial Analysis 图生视频(含音频)全球第四、Arena.ai 第 8。百器AI 未实测,本文区分官方口径与独立事实。

产品发布

Vidu S2 发布:视频生成转向「实时操控」,S2-Avatar 与 S2-Editing 双模型拆解

生数科技 9 月 16 日发布 Vidu S2,含 S2-Avatar(持续交互数字角色,实时输出 720P、支持互动中加入参考图)与 S2-Editing(视频流实时编辑)双模型,并探索空间视频。发布即全量开放,与同类模型的限量预览策略形成对照。百器AI 未实测,本文区分官方口径与独立事实。

产品发布

OpenAI 发布 GPT-Image 2.5:Flare/Sunburst 双模型首次拆档,生成速度最高快 50%,新增手绘草图输入

9 月 9 日 OpenAI 发布 ChatGPT Images 2.5:API 首次拆出 gpt-image-2.5-flare(速度档,生成延迟最多减半)与 gpt-image-2.5-sunburst(质量档)两个模型,新增 Sketch 手绘草图参考输入,编辑精度与细节锐度提升。图像生成从「单一模型拼效果」进入「按场景分档」阶段——与 DeepSeek V4.1 Flash 同周,头部厂商不约而同选择了快慢分档的产品策略。