DataLearner 标志

Qwen3-235B-A22B-Thinking-2507

推理大模型QwenQwen3
发布时间: 2025-07-25更新于: 2025-07-27浏览量: 1,368
API 价格
¥0.002 / ¥0.02
输入 / 输出 · 每千 tokens
查看全部价格
上下文长度
256K
最大输出 32K
最佳榜单名次
第 39 / 177
AIME2025 第 36 / 111
查看全部评测
是否开源
开源
Apache 2.0
参数 2350亿,激活 220亿
查看开源信息

Qwen3-235B-A22B-Thinking-2507 is the reasoning-only update to Alibaba's flagship Qwen3 mixture-of-experts model (235B total, 22B active), released on July 25, 2025. It significantly improves logic, maths, science and coding over the original hybrid model, supports a native 256K-token context and long thinking, and is open under Apache 2.0.

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen3-235B-A22B-Thinking-2507

模型基本信息

推理过程
支持
思考模式
思考模式 (默认)
上下文长度
256K tokens
最大输出长度
32K tokens
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-07-25
模型文件大小
470.77 GB
MoE架构
是
总参数 / 激活参数
2350亿 / 220亿
知识截止
暂无数据
Qwen3-235B-A22B-Thinking-2507

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0 - 免费商用授权
在线体验
Qwen3-235B-A22B-Thinking-2507

官方介绍与博客

Qwen3-235B-A22B-Thinking-2507

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-¥0.0020/ 1K tokens¥0.020/ 1K tokens
international
类型适用条件输入输出
文本-$0.230/ 1M tokens$2.30/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Qwen3-235B-A22B-Thinking-2507

评测结果

Qwen3-235B-A22B-Thinking-2507 当前已收录的代表性评测结果包括 MMLU-Pro(39 / 177,得分 84.40)、AIME2025(36 / 111,得分 92.30)、LiveCodeBench(46 / 126,得分 74.10)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU-Pro
思考模式
84.40
39 / 177
HLE
思考模式
18.20
170 / 240

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
思考模式
81.10
122 / 255

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
思考模式
74.10
46 / 126

数学

共 3 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
思考模式
92.30
36 / 111
5.20
19 / 26
0
72 / 80

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1365.80
72 / 112
Qwen3-235B-A22B-Thinking-2507

模型变体及不同版本下载

变体名称版本类型量化类型模型大小HuggingFace 地址
Qwen3-235B-A22B-Thinking-2507-FP8ℹ️InstructFP8236.45 GB下载地址
Qwen3-235B-A22B-Thinking-2507

发布机构

Qwen3-235B-A22B-Thinking-2507

模型解读

阿里巴巴开源的Qwen3-235B-A22B模型的升级版本,最早的Qwen3-235B-A22B模型是在2025年4月28日随着Qwen3系列一起发布,当时是推理和非推理模式混合的架构模型,后来阿里发现这个模式不好,因此在2025年7月份发布了更新版的模型,即不支持推理模式的Qwen3-235B-A22B-2507和支持推理模式的Qwen3-235B-A22B-Thinking-2507。

Qwen3-235B-A22B-Thinking-2507最多可以支持80K的推理过程长度,最高支持32K的答案输出,是当前推理过程最长的模型之一!

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码