DataLearner 标志
QW

Qwen3.8-Max-0902

推理大模型编程大模型

Qwen3.8-Max-0902

别名:qwen3.8-max-2026-09-02

发布时间: 2026-09-02浏览量: 4
在线体验GitHubHugging Face对比
模型参数
2.4万亿
上下文长度
1M
多语言支持
支持
推理能力
5/5

Qwen3.8-Max-0902 是阿里巴巴于 2026 年 9 月 2 日发布的 Qwen3.8-Max 升级快照,官方别名为 qwen3.8-max-2026-09-02。它沿用 2.4T 参数和 1M 上下文,进一步针对 Coding 与 Cowork 后训练,增强工程级编程、长周期自主开发、多工具协作和原生视觉理解;QwenCloud API 定价为每百万 token 输入 2 美元、输出 6 美元。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen3.8-Max-0902

模型基本信息

推理过程
支持
思考模式
思考水平 · 极高 (Extra-High) (默认)思考水平 · 低 (Low)思考水平 · 高 (High)
上下文长度
1M tokens
最大输出长度
131K tokens
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2026-09-02
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
2.4万亿 / 950亿
知识截止
暂无数据
Qwen3.8-Max-0902

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Qwen3.8-Max-0902

官方介绍与博客

DataLearnerAI博客
暂无
Qwen3.8-Max-0902

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$2.00/ 1M$6.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本-$2.50/ 1M
缓存状态 = explicit
$0.170/ 1M
缓存状态 = explicit
文本-$0.250/ 1M
缓存状态 = implicit

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Qwen3.8-Max-0902

评测结果

Qwen3.8-Max-0902 当前已收录的代表性评测结果包括 NL2Repo-Bench(1 / 12,得分 64.90)、AutomationBench(1 / 12,得分 50.80)、DeepSWE(4 / 32,得分 69.30)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

编程与软件工程

共 5 项评测
评测名称 / 模式
得分
排名/总数
DeepSWE
极高工具
69.30
4 / 32
NL2Repo-Bench
极高工具
64.90
1 / 12
MLS Bench
极高工具
50.10
1 / 5
SWE-Marathon
极高工具
44.80
1 / 6
Program Bench
极高工具
28
5 / 7

AI Agent - 工具使用

共 4 项评测
评测名称 / 模式
得分
排名/总数
ClawEval-MM
极高工具
80.20
1 / 2
73.30
7 / 10
AutomationBench
极高工具
50.80
1 / 12
Terminal-Bench 3.0
极高工具
29
3 / 7

Agent能力评测

共 2 项评测
评测名称 / 模式
得分
排名/总数
CoWorkBench
极高工具
76.10
1 / 2
Job Bench
极高工具
64
1 / 4

多模态理解

共 3 项评测
评测名称 / 模式
得分
排名/总数
BabyVision
极高工具
93.80
1 / 6
MMMU-Pro
极高
82.70
2 / 8
ERQA
极高
78.30
1 / 2

和其他模型对比

Qwen3.8-Max-0902

发布机构

Qwen3.8-Max-0902

模型解读

Qwen3.8-Max 的 0902 升级快照

Qwen3.8-Max-0902 是阿里巴巴通义千问团队于 2026 年 9 月 2 日发布的 Qwen3.8-Max 升级快照,官方同时给出别名 qwen3.8-max-2026-09-02。它不是对旧条目的静默替换:Qwen 的发布材料将 0902 与原版并列展示,QwenCloud 也提供独立模型页和 API 名称,因此 DataLearner 将其作为可独立评测和调用的日期版本记录,并保留原 Qwen3.8-Max 的历史数据。

规格与能力

模型延续 Qwen3.8-Max 的 2.4T 总参数与约 1M tokens 上下文。QwenCloud 标注普通模式最大输入约 991K、思考模式最大输入约 983K、最大输出约 131K,最大推理预算 262K;输入支持文本、图像和视频,输出为文本。官方页面列出的能力包括前缀续写、函数调用、上下文缓存、结构化输出、批处理、Web 搜索、代码解释器以及图像搜索等内置工具。

本次升级重点

官方说明 0902 版本在 Coding 与 Cowork 数据上继续后训练,重点提高复杂企业任务、科研分析和长周期工作流表现。QwenCloud 进一步说明其工程级编程与长周期自主开发能力得到加强,多工具编排和端到端任务交付更稳定,原生视觉理解也在图表推理、文档解析和多模态感知方面得到改进。

官方评测

Qwen 公布的对比表显示,0902 相对原版在多项编程和智能体评测上提升:Terminal-Bench 3.0 为 29.0(原版 11.3)、DeepSWE 1.1 为 69.3(56.6)、NL2Repo-Bench 为 64.9(55.9)、ProgramBench 为 28.0(10.5)、SWE-Marathon 为 44.8(39.1)、MLS-Bench-Lite 为 50.1(41.0)、QwenSWEBench V2 为 70.0(55.1)、CoWorkBench 为 76.1(74.8)、JobBench 为 64.0(53.4)、Toolathlon Verified 为 73.3(72.5)。多模态项目中,MMMU-Pro 为 82.7、ERQA 为 78.3、ClawEval-MM Pass@3 为 80.2、BabyVision(带代码解释器)为 93.8。以上是厂商公布成绩,不同项目使用 Claude Code、mini-SWE-agent、代码解释器或内部评测环境,不能脱离具体 harness 与工具条件直接比较。

API 与定价

Qwen3.8-Max-0902 已在 QwenCloud API 上线,模型名为 qwen3.8-max-0902。官方每百万 tokens 定价为输入 2 美元、输出 6 美元;隐式缓存命中为 0.25 美元,显式缓存创建为 2.50 美元、显式缓存读取为 0.17 美元。

官方资料

Qwen3.8-Max-0902

常见问题

Qwen3.8-Max-0902 与 Qwen3.8-Max 是同一个条目吗?

不是。0902 是官方提供独立 API 名称、独立模型页和独立评测的日期快照;它继承 Qwen3.8-Max 的架构与规格,但应保留为独立发布记录。

Qwen3.8-Max-0902 的上下文和最大输出是多少?

QwenCloud 标注总上下文为 1M tokens,普通模式最大输入约 991K、思考模式最大输入约 983K,最大输出约 131K,最大推理预算为 262K。

这次升级主要改进了什么?

官方称其继续在 Coding 与 Cowork 数据上后训练,重点增强工程级编程、长周期自主开发、复杂企业任务、多工具协作、科研分析和原生视觉理解。

Qwen3.8-Max-0902 的 API 价格是多少?

QwenCloud 每百万 tokens 收取 2 美元输入费和 6 美元输出费;隐式缓存命中为 0.25 美元,显式缓存创建为 2.50 美元、读取为 0.17 美元。

Qwen3.8-Max-0902 是否开放权重?

官方为 0902 提供的是 QwenCloud API 快照,没有发布对应日期快照的独立权重;不要把原 Qwen3.8-2.4T-A95B 权重页当作 0902 的权重下载页。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码