Qwen3.8-Max
推理大模型编程大模型Qwen3.8-Max
Qwen3.8-Max 是阿里巴巴于 2026-08-03 正式发布的千问旗舰大模型(区别于 7 月 19 日上线的 Qwen3.8-Max-Preview),总参数 2.4T、激活参数 95B,支持视觉理解与约 1M 上下文,官方称第三方榜单排名仅次于 Claude 系列;国内 API 定价输入 12 元/输出 36 元每百万 tokens,官方计划下周开源权重(同时宣布开源 Qwen3.8-27B)。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
模型基本信息
开源和体验地址
官方介绍与博客
API接口信息
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥12.00/ 1M | ¥36.00/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $2.00/ 1M | $6.00/ 1M |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | - | ¥1.50/ 1M |
评测结果
和其他模型对比
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
发布机构
模型解读
发布背景与定位
Qwen3.8-Max 是阿里巴巴通义千问团队于 2026 年 8 月 3 日正式发布的 Qwen 系列旗舰大模型,区别于 2026 年 7 月 19 日上线、仍在迭代中的预览版 Qwen3.8-Max-Preview。官方将其定位为面向编程、专业办公、科研分析与长程任务端到端交付的「超大杯」旗舰模型,已通过千问 AI 平台开放 API 服务,并集成到阿里同期发布的智能体产品「Qwen Office」中。发布会同时宣布配套的开源稠密模型 Qwen3.8-27B 也计划在未来一周内开源。
架构与技术规格
Qwen3.8-Max 采用稀疏 MoE 架构与混合注意力机制的联合优化,总参数量达 2.4 万亿(2.4T),单 token 激活参数约 950 亿(95B)。支持视觉理解(图像、视频输入),官方云平台元数据显示上下文窗口为 983,616 tokens(约 1M,部分报道称约 1M tokens),最大输出长度 131,072 tokens。模型仅支持思考模式、无法关闭推理,提供 low / high / xhigh 三档强度,默认 xhigh,对应约 131,072 tokens 的默认思考预算。
性能表现(厂商发布会公布,官方模型卡与独立评测尚未发布)
据阿里官方发布会披露:在其编程智能体评测中较上一代大幅提升 28.2 分,以 93.0 分刷新自身评测新高;在 WideSearch 评测中得分 81.9;在 Agent's Last Exam 评测中得分 52.4。第三方 Chatbot Arena 类榜单显示该模型综合排名仅次于 Anthropic Claude 系列。以上数据均为发布会现场及后续媒体报道口径,截至本文撰写官方尚未发布完整模型卡或技术报告披露具体测试方法与基准细节,独立第三方复测结果待跟进,DataLearner 暂缓录入结构化评测分数,待官方基准表公布后补充。
应用案例
发布会展示了法律合同审查(每小时处理 1284 条条款)、量化投研(6000+ 因子回测)等企业级应用场景,以及模型自主编程 16 天、在 oh-my-cli 项目完成 265 次代码提交等长程自主任务演示。
访问方式、价格与开源计划
API 已通过千问 AI 平台开放,国内定价为输入 12 元/百万 tokens、输出 36 元/百万 tokens,隐式缓存命中价格 1.5 元/百万 tokens。国际定价官方口径为 Anthropic Claude Opus 5 输入价格的 40%、输出价格的 24%(按 Opus 5 官方价格输入 5 美元/输出 25 美元每百万 tokens 折算,约合 2 美元/百万 tokens 输入、6 美元/百万 tokens 输出;此为换算结果,非官方直接公布的绝对美元数字)。官方宣布 Qwen3.8-Max 权重计划于「下周」开源,届时将是千问 Max 级别旗舰模型首次开源权重;截至本文撰写权重尚未发布,当前仅可通过 API 访问,许可与开源状态将在正式开源后更新。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
