Qwen3.6-35B-A3B 是什么模型?
Qwen3.6-35B-A3B 是阿里巴巴于 2026-04-16 发布的推理大模型。支持文本、图像、视频输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、公开评测,便于核对规格和使用成本。
Qwen3.6-35B-A3B (MoE 架构, 35B 总参数, 3B 激活参数)
阿里云通义实验室于 2026 年 4 月 16 日发布并开源的 Qwen3.6 系列高效稀疏 MoE 模型:350 亿总参数,但每次推理仅激活 30 亿参数——这个激活比例让它在显著降低计算成本和推理延迟的同时保持可用性能。原生 200K 上下文(部分任务评测使用 256K 配置)、80K 最大输出,Apache 2.0 开源,原生支持文本、图像和视频输入并延续思考/非思考双模式。核心定位是「智能体编程利器」:在 SWE-bench Verified 73.4、SWE-bench Multilingual 67.2、Terminal-Bench 2.0 51.5 等基准上大幅超越前代 Qwen3.5-35B-A3B,并可与更大体量的稠密模型相媲美;视觉侧 RefCOCO 92.0、ODInW13 50.8,多数基准与 Claude Sonnet 4.5 持平甚至超越。但要清楚它的边界——库内实测 HLE 21.40 在 181 个模型中排第 123,Tool Decathlon 26.90 在 10 个中垫底,IMO-AnswerBench 78.90 排 23 个第 21:3B 激活参数换来的低成本,代价是硬核推理和长程工具编排上的能力上限。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Qwen3.6-35B-A3B 当前已收录的代表性评测结果包括 GPQA(2 / 16,得分 86)、C-Eval(7 / 48,得分 90)、MMLU Pro(25 / 133,得分 85.20)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
Qwen3.6-35B-A3B 是阿里云通义实验室于 2026 年 4 月 16 日发布并开源的新一代大型语言模型,属于 Qwen3.6 系列中的高效稀疏混合专家(MoE)模型[reference:2]。
模型概览与核心定位
Qwen3.6-35B-A3B 采用 MoE 架构,拥有 350 亿总参数,但在每次推理时仅需激活 30 亿参数[reference:3]。此设计使其在显著降低计算成本与推理延迟的同时,仍能保持强大的性能表现[reference:4]。该模型的核心定位是作为一款“智能体编程利器”,在智能体(Agentic)编程任务上表现卓越,大幅超越其前代 Qwen3.5-35B-A3B,并可与更大体量的稠密模型(如 Qwen3.5-27B、Gemma-31B)相媲美[reference:5]。作为一款原生多模态模型,它支持图文、文档分析及空间智能等多种任务,延续了“思考/非思考”双模式,是当时最具通用性的开源模型之一[reference:6]。
架构与技术规格
核心能力与支持模态
性能与基准评测
官方公布的部分基准测试得分如下:
应用场景与限制
访问方式与许可
Qwen3.6-35B-A3B 是阿里巴巴于 2026-04-16 发布的推理大模型。支持文本、图像、视频输入和文本输出,上下文窗口为 200K,主要能力包括推理大模型、多语言。页面已收录官方资料、公开评测,便于核对规格和使用成本。
当前官方资料记录其支持文本、图像、视频输入,并生成文本输出。
上下文窗口为 200K,最大输出为 80K。未公开或无法确认的规格不做推测。
根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。
代码与模型权重按 Apache 2.0 记录;使用前仍应核对官方许可原文。
The checkpoint is listed under the Apache 2.0 license, with the license link included in the model references. Review the linked license text before commercial or derivative use.
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
