Qwen4-Flash
已官宣推理大模型Qwen4-Flash
别名:Qwen-4-Flash / Qwen4 Flash
Qwen4-Flash 是阿里巴巴于 2026 年 9 月 22 日云栖大会上首次公开的 Qwen4 系列高速档位。该档位与 Qwen4-Max、Qwen4-Plus、Qwen4-27B 一同出现在 Qwen4 产品线路线图中,官方称 Qwen4 已在训练中。截至 2026 年 9 月 22 日,Qwen4-Flash 尚未发布,推理速度、上下文长度和定价均未公布。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
模型基本信息
开源和体验地址
官方介绍与博客
API接口信息
发布机构
模型解读
收录状态
Qwen4-Flash 是阿里巴巴在 2026 年 9 月 22 日杭州云栖大会开幕式上首次公开的 Qwen4 系列成员,定位为该系列面向高吞吐、低时延场景的高速(Flash)档位。阿里巴巴 ATH 事业群 Token Foundry 与 Qwen LLM 项目负责人刘大一恒在同一场演讲中表示「基于新一代架构的 Qwen4 已在训练中」,并公开了 Qwen4 的四档产品线:旗舰 Qwen4-Max、高速 Qwen4-Flash、均衡 Qwen4-Plus 与开源 Qwen4-27B。截至本条目更新时,Qwen4-Flash 尚未开放使用。
系列定位
Qwen4-Flash 在 Qwen 现有分档中对应 Qwen3.8-Flash 所在的档位。Flash 档位强调推理速度与单位成本,通常是同代中最先被大规模调用的档位。档位名称的延续只说明产品线规划,不代表新一代在规格、上下文长度或价格上沿用前代取值。
架构线索
Qwen 团队此前将 2026 年 8 月 28 日开源的 Qwen3.8-Flash-Next 描述为下一代 Qwen4 架构的实验性预览,重点是超稀疏 MoE 与新的注意力/信息传递设计,用于在大幅降低训练成本的前提下验证新架构。该模型的公开规格属于 Qwen3.8 代,不能直接套用到 Qwen4 的任一档位。
同场路线图还提到 Qwen4.5 与 Qwen5 的参数规模计划迈向 5 万亿至 10 万亿,该数字对应的是 Qwen4 之后的世代,不是本条目的参数规模。
证据边界
本次公开属于产品线预告,不是模型发布。截至 2026 年 9 月 22 日,Qwen4 的四个档位均没有模型卡、开源权重、API 模型标识、阿里云百炼上架记录、定价页或任何官方 benchmark 成绩。阿里也未给出具体发布日期,只表示「很快发布」。
DataLearner 以「已官宣未开放」收录该条目:名称与档位定位来自官方现场材料,其余字段(参数规模、激活参数、上下文长度、最大输出、模态、思考档位、知识截止时间、许可证、价格、评测)在官方公布前一律留空,不从 Qwen3.8 同名档位继承。页面显示的日期是按惯例推断的预计时间,不是官方发布计划。
信息来源
- 新浪科技(2026 年 9 月 22 日):阿里 Qwen4.5 后模型将扩展至 5-10T 参数,Qwen4 很快发布:刘大一恒关于「Qwen4 已在训练中」的表述出处。
- LINUX DO:qwen4 系列首曝,下一代 max、plus、qwen4-27B(云栖大会上午场总结):现场对产品线分档的记录。
- X @AiBattle_:Qwen 4 models have been officially announced at the Apsara Conference:英文社区对同一张路线图的转述,列出 Max / Flash / Plus / 27B 四档。
- 2026 云栖大会官方页面:会议时间与议程;后续以 Qwen 官方博客、模型卡与阿里云百炼文档确认正式发布信息。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
