Qwen3.8-Max-Preview 和正式版 Qwen3.8-Max 是什么关系?该用哪个?
Preview 是 2026 年 7 月 19 日上线的云端预览服务,正式版 Qwen3.8-Max 已于 2026 年 8 月 3 日发布。新项目应直接使用正式版:它提供默认 1M 上下文、非思考模式、官方内置工具,底座权重也已在 8 月 12 日以 Qwen3.8-2.4T-A95B 之名开源。Preview 条目保留是为了记录这一阶段的规格差异。
Qwen3.8-Max-Preview
Qwen3.8-Max-Preview 是阿里云 Qwen 团队于 2026 年 7 月 19 日上线的 Qwen3.8 系列旗舰预览模型,目前已被 2026 年 8 月 3 日发布、8 月 12 日开源底座权重的 Qwen3.8-Max 正式版取代,选型请转到正式版条目。预览期官方确认该系列总参数达 2.4 万亿,并称其为 Qwen 首个万亿参数级多模态模型,具备图片理解能力;服务侧配置给出上下文 983,616 Token、最大输出约 131,072 Token。推理机制上有两点直接影响成本:仅支持思考模式无法关闭,提供 low/high/xhigh 三档、默认 xhigh,未设置时默认思考预算约 131,072 Token;默认开启 preserve_thinking,多轮对话需回传 reasoning_content 并计入输入 Token。预览期始终未公布架构(Dense 或 MoE)、激活参数、训练数据、知识截止时间与标准化 Benchmark,因此无法与 GPT-5.6、Claude Fable 5 等模型有效对比。它主要通过阿里云百炼 Token Plan 与 Qoder 生态提供,没有标准按量单价。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Qwen3.8-Max-Preview 是阿里云 Qwen 团队于 2026 年 7 月 19 日上线的 Qwen3.8 系列旗舰预览模型。需要先说清楚它现在的位置:Qwen3.8-Max 正式版已于 2026 年 8 月 3 日发布,底座权重也在 8 月 12 日开源。因此这个 preview 型号已完成其阶段性使命,规格、评测与价格请以正式版条目为准,本页保留的是预览期的信息状态与那些当时未公开的空白。
官方在上线时确认 Qwen3.8 系列总参数规模达到 2.4 万亿,并强调模型仍在持续演进。团队成员同日进一步将其描述为 Qwen 首个达到万亿参数规模的多模态模型,上下文窗口约 1M Token;阿里云 Token Plan 的模型目录也把它的能力标记为推理、视觉理解和文本生成——也就是说它已经不是纯文本模型,具备图片理解能力。视频、音频等更复杂的交互能力当时未有说明。
具体到服务侧配置,部分接入文档给出的上下文为 983,616 Token、最大输出约 131,072 Token。这些是当时的服务配置数值,而非正式技术规格,不同接入渠道可能有差异。
预览期 API 文档披露的两条机制值得单独记一笔,因为它们直接影响成本:
reasoning_content,这些历史思考内容会占用上下文并计入输入 Token。好处是长任务的推理连续性更好,代价是上下文消耗显著增加。预览期的一个关键事实是:官方始终没有公布模型架构(Dense 还是 MoE)、激活参数规模、训练数据构成、知识截止时间,也没有发布标准化 Benchmark 结果。产品文档虽然强调它在大型代码库处理、跨文件修改、复杂数据分析和多步骤任务上相比 Qwen3.7-Max 有提升,但缺少统一评测口径,无法与 GPT-5.6、Claude Fable 5 等模型做有效对比。
访问方式也与常规 API 不同:它主要通过阿里云百炼 Token Plan 和 Qoder 生态(桌面客户端、CLI、JetBrains 插件、云端 Agent)提供,更像是集成进开发工具,而不是独立 API 服务;当时也没有公布标准的按量 Token 单价,Token Plan 套餐与 Qoder Credits 折扣属于订阅或活动机制,不能当作标准价格看待。
阿里云当时就已说明,qwen3.8-max-preview 属于预览模型,能力可能在预览期间持续调整,预览结束后可能下线或由正式版本替代——这一点现在已经应验。不要把预览版的模型 ID 当作长期稳定接口,生产环境请迁移到正式版。
Preview 是 2026 年 7 月 19 日上线的云端预览服务,正式版 Qwen3.8-Max 已于 2026 年 8 月 3 日发布。新项目应直接使用正式版:它提供默认 1M 上下文、非思考模式、官方内置工具,底座权重也已在 8 月 12 日以 Qwen3.8-2.4T-A95B 之名开源。Preview 条目保留是为了记录这一阶段的规格差异。
阿里云 Token Plan 的接入配置提供约 98 万 tokens 上下文窗口和最高 13.1 万 tokens 输出。注意这与正式版的 1M 上下文、128K 输出略有差异,是预览阶段的服务侧配置。
主要通过阿里云 Token Plan、Qoder 和 QoderWork 三个入口进行早期体验。当前提供的是云端 Preview 服务而非可下载自部署的权重——预览阶段没有开放模型权重。
不能。模型始终启用思考,支持 low、high、xhigh 三档推理强度。非思考模式是正式版 Qwen3.8-Max 才提供的能力。
没有。官方只确认了总参数规模达 2.4 万亿,并由团队成员透露它是 Qwen 首个达到万亿参数规模的多模态模型、上下文窗口约 1M tokens。是否采用 Dense 或 MoE 架构、激活参数规模、训练数据和完整评测结果在预览阶段均未披露——这些要到正式版才有官方数据(正式版为 MoE,激活参数 950 亿)。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
