DataLearner 标志
QW

Qwen3-0.6B

推理大模型Qwen3

Qwen3-0.6B

发布时间: 2025-04-28更新于: 2025-04-28浏览量: 1,732
在线体验GitHubHugging Face对比
模型参数
6亿
上下文长度
128K
多语言支持
支持
推理能力
2/5

Qwen3-0.6B 是由 阿里巴巴 发布的 AI 模型,发布时间为 2025-04-28,定位为 推理大模型,参数规模约为 6亿,上下文长度为 128K,模型文件大小约 1.2GB,采用 Apache 2.0 许可,在 GPQA Diamond 上取得 23.90 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Qwen3-0.6B

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-04-28
模型文件大小
1.2GB
MoE架构
否
总参数 / 激活参数
6亿 / 不适用
知识截止
暂无数据
Qwen3-0.6B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Qwen3-0.6B

官方介绍与博客

Qwen3-0.6B

API接口信息

接口速度
5/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-¥0.0001/ 1K tokens¥0.0003/ 1K tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Qwen3-0.6B

评测结果

Qwen3-0.6B 当前已收录的代表性评测结果包括 HLE(472 / 568,得分 5.60)、τ²-Bench - Telecom(244 / 264,得分 21.10)、AIME2025(201 / 215,得分 18)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 2 项评测
评测名称 / 模式
得分
排名/总数
HLE
常规模式
4.90
492 / 568
HLE
思考模式
5.60
472 / 568

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
23.10
459 / 461
GPQA Diamond
思考模式
23.90
458 / 461

算法与竞赛编程

共 2 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
7.30
249 / 251
LiveCodeBench
思考模式
12.10
247 / 251

数学

共 2 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
常规模式
10.30
208 / 215
AIME2025
思考模式
18
201 / 215

客服与业务流程

共 2 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench - Telecom
常规模式工具
14.60
259 / 264
τ²-Bench - Telecom
思考模式工具
21.10
244 / 264

指令与格式遵循

共 2 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
常规模式
21.90
277 / 282
IF Bench
思考模式
23.30
276 / 282
Qwen3-0.6B

发布机构

Qwen3-0.6B

模型解读

Qwen3-0.6B是阿里开源的第三代千问大模型中参数规模最小的版本,仅6亿参数,1.2GB显存即可运行。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码