本页的 V4 Flash 是否被下线或删除?
没有,本次只更新信息和评测,保留既有生命周期状态与独立模型记录。API 兼容名路由和原模型记录分开管理。
DeepSeek V4 Flash
V4 Flash 独立记录及生命周期保持不变:284B/13B MoE,保留原有权重和历史数据。补齐 2026-09-10 官方表中 0731 版本 max 评测,并区分当前 API 兼容路由与原模型历史价格。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.140/ 1M tokens | $0.280/ 1M tokens |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | — | $0.0028/ 1M tokens |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
DeepSeek-V4-Flash 当前已收录的代表性评测结果包括 LiveCodeBench(5 / 128,得分 91.60)、MMLU Pro(17 / 134,得分 86.40)、CodeForces(3 / 21,得分 3289)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
本页继续保留 DeepSeek V4 Flash 独立模型记录与既有生命周期状态,不执行下线、删除或模型页面重定向。2026 年 9 月 10 日发布表中的 V4 Flash 0731 一栏补充了最新对比成绩;它不是 V4.1 Flash,参数、权重与历史评测不可互相覆盖。
GPQA Diamond 89.9;HLE 纯文本子集 37.8(不是完整 HLE);Codeforces Rating 3289;MathArena Apex 58.6;Terminal-Bench 2.1/3.0/4.0:82.7/7.6/7.0;DeepSWE v1.1 54.4;NL2Repo-Bench 54.2;CyberGym 76.7;SEC-Bench Pro 30.9;ExploitGym 1.8(预算未注明);HLE(带工具)51.5;Automation-Bench 37.7;Agents’ Last Exam 25.2。
本次提供的成绩按 max effort 写入,标准知识、数学和竞赛编程项目区分为无工具,Agent 项与明确 w/tools 项区分为带工具;不额外推断联网。HLE 37.8 星号为纯文本子集,单列为独立基准,避免与完整 HLE 混合。ExploitGym 因时间预算未说明,不归入 2h/6h/unlimited。ProgramBench 和视觉评测列为破折号,表示没有给出成绩,不录成 0。0731 原表的 Toolathlon Verified 70.3 及其他已有模式、第三方历史成绩保留。Automation-Bench 本次表为 37.7,替换同一 max 带工具条目原 25.1;旧表来源与变化在本地数据记录中保留。
保留既有规格:284B 总参数、13B 激活参数的 MoE,文本输入及文本输出、1M 上下文、384K 最大输出。V4 系列结合 Compressed Sparse Attention(CSA)、Heavily Compressed Attention(HCA)、mHC 超连接和 Muon 优化器。原 V4 Flash 开放权重及原有 MIT 许可不因 API 路由变化而改变;0731 是 API 后训练更新,不能视作此前开源权重同步升级。
根据所给 2026-09-10 资料,deepseek-v4-flash 调用名暂时路由到 V4.1 Flash,推荐调用名为 deepseek-flash。当前通过该兼容名发出的请求执行的是新模型,并按新模型峰谷价计费;这与本页原 V4 Flash 模型记录的生命周期、权重和历史评测分开管理。
本页原模型价格记录为历史价格:每百万 tokens 缓存命中输入 $0.0028、未命中输入 $0.14、输出 $0.28,不是当前兼容名路由后的报价。V4.1 Flash 新价格另列于其页面:每百万 tokens 空闲时段缓存命中输入/未命中输入/输出为人民币 0.02/1/4 元,高峰为 0.04/2/8 元;高峰为北京时间工作日 09:00–12:00、14:00–18:00。
原模型支持非思考、high、max,原有思考模式及默认设置保留。既有接口能力包括 OpenAI/Anthropic 兼容格式、Responses API、JSON Output、Tool Calls、前缀补全,以及非思考模式 FIM。原模型是文本模型,不能因兼容名现在路由到原生视觉模型就改成本体支持图像。
最新成绩与兼容路由依据用户提供的 DeepSeek 2026-09-10 发布资料,未另行联网核实。原 0731 官方公开 Code Agent 测试备注为 DeepSeek Harness minimal mode、max effort、temperature=1.0、top_p=0.95;不能推断所有历史榜单均使用完全相同的配置。参考:DeepSeek 更新日志。
没有,本次只更新信息和评测,保留既有生命周期状态与独立模型记录。API 兼容名路由和原模型记录分开管理。
所给资料说明该兼容名暂时路由至 V4.1 Flash,并使用 V4.1 Flash 新价格;原 V4 Flash 页面上的美元价格是历史记录。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
