先说结论
如果你的任务已经依赖稳定 API、公开评测、1M 长上下文或本地部署,优先选择 DeepSeek V4 Flash。它有可核验的规格、MIT 开源权重,以及 0731 API 更新后的 Agent/编程评测信息。
DeepSeek V4.1 Flash 不是可以直接按“新版胜旧版”理解的正式替代品:它是 DeepSeek 于 2026 年 9 月 8 日开放的限时中间预览,当前模型 ID 为 deepseek-v4.1-flash-expires-on-0910,公告端点有效至 9 月 10 日。官方确认其采用新结构、原生支持多模态,并声称能力、速度与成本有所改善;但参数量、上下文、最大输出、具体输入输出格式、许可证、开源权重和独立 benchmark 均未公开。
因此,这一组对比的重点不是给 V4.1 Flash 下性能定论,而是判断:你是需要今天可复现、可落地的能力,还是愿意在明确的到期风险下试用一条预览 API。
能力与可验证性
DeepSeek V4 Flash 是 284B 总参数、13B 激活参数的 MoE 模型,支持 1M token 上下文和最高 384K token 输出。它支持文本输入与输出,并提供 Non-think、Think High、Think Max 三档推理模式;官方 0731 API 更新重点加强了 Agent 和编程能力。目录中可核验的官方 Agent 成绩包括 Terminal Bench 2.1 82.7、NL2Repo 54.2、CyberGym 76.7、DeepSWE 54.4 与 Toolathlon Verified 70.3。评测设置和模型版本会影响横向结论,使用时仍应以与你的工具链、推理档位和任务分布相匹配的测试为准。
V4.1 Flash 目前没有可并列的官方 benchmark 行。它的“原生多模态”是已确认的产品信号,但不等同于已经公开了图像、音频等具体输入输出接口或能力边界。不要把 V4 Flash 的文本规格、开源权重或 benchmark 成绩外推给 V4.1 Flash,也不要把 V4.1 Flash 的多模态表述倒推为 V4 Flash 已支持视觉输入。
价格与运行风险
两者当前目录价格不能简单视为完全相同。V4 Flash 的标准价格为每百万 token:缓存命中输入 $0.0028、缓存未命中输入 $0.14、输出 $0.28。V4.1 Flash 按峰谷时段计费:非高峰为缓存命中输入 $0.007、未命中输入 $0.22、输出 $0.66;高峰为 $0.014、$0.44 与 $1.32。对大量复用上下文的应用,应分别按缓存命中率、输入输出比例和实际请求时段估算,不能只比较一个输入单价。
更重要的是生命周期风险。V4.1 Flash 的端点名称本身带有到期日期,适合用独立流量、回归集和故障切换方案进行试验;不要在没有替代模型和迁移预案时把它作为唯一生产依赖。V4 Flash 虽也标注为 Preview,但其 API 名称、0731 更新和已公开的部署材料使其更适合当前持续使用。
按场景选择
- 稳定的 Agent、编程与长上下文工作流:选 DeepSeek V4 Flash。它有明确上下文、推理档位、可参考的 Agent 成绩和稳定的 API/开源权重边界。
- 本地部署或需审查许可的项目:选 DeepSeek V4 Flash 的官方 MIT 权重;V4.1 Flash 未公布可用权重和许可证,不能替代这一需求。
- 想验证 DeepSeek 新结构和多模态方向:可在限时窗口内试用 V4.1 Flash,但先记录模型 ID、时间段、请求形态与结果,并保留 V4 Flash 或其他模型作为回退。
- 成本敏感的批量 API:先根据真实缓存命中率和峰谷时段测算。当前列出的 V4 Flash 标准价格更低,V4.1 Flash 的价值需要由你的任务效果与预览期实际可用性共同证明。
结语
V4.1 Flash 值得关注,但现有公开信息不足以证明它在通用质量、Agent、编码或成本上全面超过 V4 Flash。把 V4 Flash 当作当前可验证的生产基线,把 V4.1 Flash 当作有截止日期的实验候选,是这两条记录在信息完整度不同情况下更稳妥的用法。待 DeepSeek 发布稳定型号、完整规格或可复核评测后,再重新评估是否应迁移。
