DataLearner 标志
QW

Qwen2.5-Max

聊天大模型Qwen2.5

Qwen2.5-Max

发布时间: 2025-01-28更新于: 2025-02-05浏览量: 1,095
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
128K
多语言支持
支持
推理能力
暂无数据

Qwen2.5-Max 是由 阿里巴巴 发布的 AI 模型,发布时间为 2025-01-28,定位为 聊天大模型,上下文长度为 128K,模型文件大小约 0,采用 不开源 许可,在 GSM8K 上取得 94.50 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen2.5-Max

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
聊天大模型
输入/输出模态
暂无数据
发布时间
2025-01-28
模型文件大小
0
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
暂无数据
Qwen2.5-Max

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Qwen2.5-Max

官方介绍与博客

Qwen2.5-Max

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-¥0.0024/ 1K¥0.0096/ 1K
批量模式
类型适用条件输入输出
文本-¥0.0012/ 1K¥0.0048/ 1K

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Qwen2.5-Max

评测结果

Qwen2.5-Max 当前已收录的代表性评测结果包括 GSM8K(9 / 70,得分 94.50)、MBPP(10 / 70,得分 80.60)、MMLU(22 / 124,得分 87.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合评估

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
87.90
22 / 124
MMLU Pro
常规模式
76.10
80 / 133

数学推理

共 3 项评测
评测名称 / 模式
得分
排名/总数
GSM8K
常规模式
94.50
9 / 70
MATH
常规模式
68.50
24 / 42
FrontierMath
常规模式
1
52 / 60

编程与软件工程

共 2 项评测
评测名称 / 模式
得分
排名/总数
MBPP
常规模式
80.60
10 / 70
HumanEval
常规模式
73.20
28 / 101

Agent能力评测

共 1 项评测
评测名称 / 模式
得分
排名/总数
Aider-Polyglot
常规模式
21.80
48 / 59
Qwen2.5-Max

发布机构

Qwen2.5-Max

模型解读

阿里巴巴发布的Qwen2.5系列模型的闭源版本,通过名称看,可能是参数规模最大的一个版本,各项指标评分都高于Qwen2.5-72B,也略高于DeepSeek-V3。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码