DataLearner 标志
QW

Qwen4-Flash

已官宣推理大模型

Qwen4-Flash

别名:Qwen-4-Flash / Qwen4 Flash

发布时间: 2026-10-22浏览量: 1
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
暂无数据
多语言支持
暂无数据
推理能力
暂无数据

Qwen4-Flash 是阿里巴巴于 2026 年 9 月 22 日云栖大会上首次公开的 Qwen4 系列高速档位。该档位与 Qwen4-Max、Qwen4-Plus、Qwen4-27B 一同出现在 Qwen4 产品线路线图中,官方称 Qwen4 已在训练中。截至 2026 年 9 月 22 日,Qwen4-Flash 尚未发布,推理速度、上下文长度和定价均未公布。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen4-Flash

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
暂无数据
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
暂无数据
发布时间
2026-10-22
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
暂无数据
Qwen4-Flash

开源和体验地址

代码开源状态
暂无数据
预训练权重开源
暂无数据
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Qwen4-Flash

官方介绍与博客

官方论文
暂无
DataLearnerAI博客
暂无
Qwen4-Flash

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Qwen4-Flash

发布机构

Qwen4-Flash

模型解读

收录状态

Qwen4-Flash 是阿里巴巴在 2026 年 9 月 22 日杭州云栖大会开幕式上首次公开的 Qwen4 系列成员,定位为该系列面向高吞吐、低时延场景的高速(Flash)档位。阿里巴巴 ATH 事业群 Token Foundry 与 Qwen LLM 项目负责人刘大一恒在同一场演讲中表示「基于新一代架构的 Qwen4 已在训练中」,并公开了 Qwen4 的四档产品线:旗舰 Qwen4-Max、高速 Qwen4-Flash、均衡 Qwen4-Plus 与开源 Qwen4-27B。截至本条目更新时,Qwen4-Flash 尚未开放使用

系列定位

Qwen4-Flash 在 Qwen 现有分档中对应 Qwen3.8-Flash 所在的档位。Flash 档位强调推理速度与单位成本,通常是同代中最先被大规模调用的档位。档位名称的延续只说明产品线规划,不代表新一代在规格、上下文长度或价格上沿用前代取值。

架构线索

Qwen 团队此前将 2026 年 8 月 28 日开源的 Qwen3.8-Flash-Next 描述为下一代 Qwen4 架构的实验性预览,重点是超稀疏 MoE 与新的注意力/信息传递设计,用于在大幅降低训练成本的前提下验证新架构。该模型的公开规格属于 Qwen3.8 代,不能直接套用到 Qwen4 的任一档位。

同场路线图还提到 Qwen4.5 与 Qwen5 的参数规模计划迈向 5 万亿至 10 万亿,该数字对应的是 Qwen4 之后的世代,不是本条目的参数规模。

证据边界

本次公开属于产品线预告,不是模型发布。截至 2026 年 9 月 22 日,Qwen4 的四个档位均没有模型卡、开源权重、API 模型标识、阿里云百炼上架记录、定价页或任何官方 benchmark 成绩。阿里也未给出具体发布日期,只表示「很快发布」。

DataLearner 以「已官宣未开放」收录该条目:名称与档位定位来自官方现场材料,其余字段(参数规模、激活参数、上下文长度、最大输出、模态、思考档位、知识截止时间、许可证、价格、评测)在官方公布前一律留空,不从 Qwen3.8 同名档位继承。页面显示的日期是按惯例推断的预计时间,不是官方发布计划。

信息来源

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码