DataLearner 标志
HY

Hy3

推理大模型编程大模型Hunyuan

Tencent Hy3

发布时间: 2026-07-06更新于: 2026-07-17 21:57:45.7051,311
模型参数
2950亿
上下文长度
256K
中文支持
支持
推理能力

腾讯混元团队于 2026 年 7 月 6 日发布的 Hy3 正式版,采用 295B 总参数、21B 激活参数的 MoE 架构,支持 256K 上下文与可切换思考强度,并以 Apache 2.0 许可开放 BF16 和 FP8 权重。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Hy3

模型基本信息

推理过程
支持
思考模式
常规模式 (默认)思考水平 · 低 (Low)思考水平 · 高 (High)
上下文长度
256K tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2026-07-06
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
2950亿 / 210亿
知识截止
暂无数据
Hy3

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
Hy3

官方介绍与博客

官方论文
DataLearnerAI博客
暂无介绍博客
Hy3

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本上下文长度 < 16000¥1.20/ 1M¥4.00/ 1M
文本上下文长度 >= 16000, 上下文长度 < 32000¥1.60/ 1M¥6.40/ 1M
文本上下文长度 >= 32000¥2.00/ 1M¥8.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本--¥0.400/ 1M
上下文长度 < 16000
文本--¥0.600/ 1M
上下文长度 >= 16000, 上下文长度 < 32000
文本--¥0.800/ 1M
上下文长度 >= 32000
Hy3

评测结果

Hy3 当前已收录的代表性评测结果包括 AA-LCR(1 / 14,得分 73.40)、HLE(15 / 170,得分 53.20)、IMO-AnswerBench(2 / 21,得分 90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合评估

共 3 项评测
评测名称 / 模式
得分
排名/总数
90.40
19 / 187
HLE
37
69 / 170
HLE
工具
53.20
15 / 170

编程与软件工程

共 4 项评测
评测名称 / 模式
得分
排名/总数
78
23 / 111
75.80
6 / 22
57.90
14 / 51
DeepSWE
工具
28
16 / 17

AI Agent - 信息收集

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
工具联网
84.20
9 / 52

AI Agent - 工具使用

共 3 项评测
评测名称 / 模式
得分
排名/总数
MCP-Atlas
工具
79.10
7 / 27
71.70
15 / 25
48.50
3 / 9

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
90
2 / 21

长上下文能力

共 1 项评测
评测名称 / 模式
得分
排名/总数
73.40
1 / 14

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

Hy3

发布机构

腾讯AI实验室
腾讯AI实验室
查看发布机构详情
Tencent Hy3

模型解读

Hy3 是腾讯混元团队于 2026 年 7 月 6 日发布的 Hy3 正式版。腾讯在 4 月底推出 Hy3 Preview 后,从 50 多个业务团队收集反馈,修复任务执行和交互问题,并扩充后训练数据的质量、类型与强化学习规模。正式版继续面向复杂推理、代码开发、智能体工作流和长上下文任务,同时重点改善真实产品中的稳定性与可靠性。

官方已经在 Hugging Face、ModelScope、GitCode 和 CNB 开放模型权重,并在 GitHub 提供推理、微调与部署说明。除 BF16 权重外,官方还提供 Hy3-FP8 量化权重;量化版本不作为独立模型条目收录。


架构与技术规格

Hy3 采用快慢思考融合的混合专家(MoE)架构,总参数量为 295B,每个 token 激活 21B 参数,另包含 3.8B 参数的 MTP 层。模型共有 80 层主网络、192 个路由专家,每层激活 8 个专家,并使用一个常驻共享专家。注意力部分采用 64 个 GQA 查询头和 8 个 KV 头,隐藏维度为 4096,上下文窗口为 256K tokens

正式版原生支持普通回答和深度思考。官方调用示例通过 reasoning_effortno_thinklowhigh 之间切换,其中 no_think 为默认模式。模型也提供适配 vLLM 与 SGLang 的部署方案,支持工具调用解析、思考内容解析和 MTP 推测解码。


从 Preview 到正式版的改进

腾讯表示,正式版提高了后训练数据的质量和多样性,并扩大强化学习训练规模。在由 270 名不同领域专家参与、包含 312 组有效对比的真实工作流盲测中,Hy3 获得 2.67/4,官方对照中的 GLM-5.1 为 2.51/4;差异主要出现在前端开发、CI/CD、数据与存储任务。

官方 benchmark 附录显示,Hy3 在最高推理强度下取得 SWE-bench Multilingual 75.8、SWE-bench Verified 78.0、SWE-bench Pro 57.9、Terminal-Bench 2.1 71.7、BrowseComp 84.2、MCP-Atlas 79.1、GPQA Diamond 90.4、IMO-AnswerBench 90.0 和 AA-LCR 73.4。HLE 无工具成绩为 37.0,使用工具后为 53.2。

生产可靠性是这次更新的重点。官方报告称,经过针对性数据清洗和训练约束后,内部真实场景中的幻觉率从 12.5% 降至 5.4%,常识错误率从 25.4% 降至 12.7%。在多轮对话测试中,指代、省略恢复与约束继承相关的问题率从 17.4% 降至 7.9%;开源长对话基准 MRCR 的成绩从 42.9% 提升到 75.1%。

Hy3 还修复了输出格式和工具调用方面的基础稳定性问题,减少无效调用导致的循环,并改善错误恢复。腾讯称,同一模型在 CodeBuddy、Cline 和 KiloCode 等不同智能体脚手架上的 SWE-Bench Verified 准确率差异控制在 4% 以内,说明其工具调用行为对运行框架的敏感度有所降低。


API 价格、部署与许可

腾讯云 TokenHub 的 Hy3 采用按输入长度分段的人民币计价:输入长度低于 16K 时,输入、输出和缓存命中分别为 1.2 元、4 元和 0.4 元/百万 tokens;16K–32K 时分别为 1.6 元、6.4 元和 0.6 元;32K 及以上时分别为 2 元、8 元和 0.8 元。正式版沿用 Preview 的同一费率。

Hy3 的主要输入与输出均为文本,适合代码开发、文档处理、金融分析、游戏开发、前端设计、多步工具调用和长上下文任务。官方推荐使用 vLLM 或 SGLang 部署,并建议大型服务使用 8 张 H20-3e 或其他大显存 GPU;完整微调流水线也随仓库一并开放。

Hy3 的代码与模型权重采用 Apache License 2.0

Hy3

常见问题

Hy3 是什么模型?

腾讯混元团队于 2026 年 7 月 6 日发布的 Hy3 正式版,采用 295B 总参数、21B 激活参数的 MoE 架构,支持 256K 上下文与可切换思考强度,并以 Apache 2.0 许可开放 BF16 和 FP8 权重。

Hy3 支持哪些输入和输出模态?

当前官方资料记录其支持文本输入,并生成文本输出。

Hy3 的上下文窗口和最大输出是多少?

上下文窗口为 256K。未公开或无法确认的规格不做推测。

Hy3 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言、编程大模型相关任务;实际效果应结合具体工作流验证。

Hy3 是否提供 API,价格如何查看?

页面已收录 腾讯AI实验室 的 9 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Hy3 是否开源?

代码与模型权重按 Apache 2.0 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码