Hy4 preview 已经正式发布并开源了吗?
是。腾讯于 2026 年 8 月 28 日发布 Hy4 preview,并开放 BF16 原始权重与 FP8 量化权重。代码和模型权重采用 Apache License 2.0;它仍被官方定义为 Hy4 的早期 preview 版本。
腾讯 Hy 团队于 2026 年 8 月 28 日发布并开源的 770B-A49B MoE 旗舰推理模型,原生支持 1,048,576 tokens 上下文、high 与 no_think 两种推理模式,并强化长程软件工程、办公分析、游戏开发和科学研究。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥6.00/ 1M | ¥18.00/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.834/ 1M | $2.50/ 1M |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | — | $0.042/ 1M |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
Hy4 preview 当前已收录的代表性评测结果包括 HLE(15 / 185,得分 55.40)、SWE-Bench Pro - Public(6 / 59,得分 65.70)、GPQA Diamond(24 / 226,得分 92.30)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
Hy4 preview 是腾讯 Hy 团队于 2026 年 8 月 28 日发布并开源的新一代旗舰推理模型,也是此前 Tencent Hy4(HY-4 / 混元4)传闻条目的正式落地版本。官方把它定位为面向真实生产力的早期预览版,重点覆盖长程软件工程、跨文件办公分析、游戏开发和科学研究。
模型主干采用混合专家(MoE)架构,共 770B 参数,每个 token 激活 49B。78 层主干中首层为稠密 FFN,其余 77 层各含 256 个路由专家和 1 个共享专家,每个 token 激活 8 个路由专家及共享专家。主干之外还包含一层原生 MTP:总参数 10B、激活参数 0.7B,用于推测解码。
注意力模块采用 Gated DeepSeek Sparse Attention(Gated DSA),通过 IndexCache 跨层复用稀疏索引;残差通路使用四路 identity Hyper-Connections。官方配置给出的隐藏维度为 6144、64 个注意力头、上下文窗口 1,048,576 tokens,词表大小 120,832。模型输入和输出均为文本。
Hy4 preview 默认使用 high 深度推理,也支持 no_think 直接回答;官方推荐采样参数为 temperature 0.9、top_p 1.0。开源聊天模板包含结构化工具调用和工具结果协议,官方部署示例提供 vLLM 与 SGLang 的工具解析、推理解析和 MTP 推测解码配置,服务端模型名为 hy4-preview。
腾讯同时开放 BF16 原始权重与 FP8 量化权重。Hugging Face 的 BF16 仓库约为 1.42 TiB、包含 131 个 safetensors 分片,实际自建部署通常需要多卡服务器。代码与权重采用 Apache License 2.0。
官方评测附录覆盖智能体编程、搜索、办公工具、STEM Agent 和通用推理。Hy4 preview 的代表性成绩包括 SWE-bench Multilingual 82.9、SWE-bench Pro 65.7、DeepSWE 64.3、Terminal-Bench 2.1 85.4、CyberGym 78.4、MCP-Atlas 83.7、Toolathlon-Verified 74.1、GPQA Diamond 92.3;HLE 在无工具和带工具条件下分别为 43.4 与 55.4。DataLearner 只把目录中能够准确匹配测试名称和工具口径的公开项目写入结构化评测,不把腾讯内部基准混入公开榜单。
腾讯还组织 163 名内部专家对 203 个工程任务进行盲测,Hy4 preview 平均 2.99/4,略高于官方同场测试的 GLM 5.3(2.92)与 Kimi K3(2.94)。这些结果属于厂商自测,实际效果会受到智能体脚手架、工具、超时、采样与上下文配置影响。
Hy4 preview 已在腾讯云 TokenHub 上线,官方 API 型号为 hy4-preview。中国区每百万 tokens 的缓存命中输入、普通输入和输出价格分别为 0.3 元、6 元和 18 元;官方英文页面对应列出国际价格 0.042 美元、0.834 美元和 2.501 美元。腾讯元宝、ima、CodeBuddy 与 WorkBuddy 也已提供模型体验。
腾讯明确说明这是 Hy4 的早期版本,预训练和后训练仍有提升空间。已知问题包括复杂任务上思考时间可能长于必要水平,以及反复检查、过度自我验证的倾向;因此 preview 状态不应被等同于稳定正式版。
是。腾讯于 2026 年 8 月 28 日发布 Hy4 preview,并开放 BF16 原始权重与 FP8 量化权重。代码和模型权重采用 Apache License 2.0;它仍被官方定义为 Hy4 的早期 preview 版本。
主干模型有 770B 总参数、每 token 激活 49B 参数,另含一层 10B 总参数、0.7B 激活参数的 MTP 层。官方配置的上下文窗口是 1,048,576 tokens。
官方聊天模板支持 high 和 no_think。high 是默认模式,适合数学、编程和复杂推理;no_think 用于更直接的回答。官方推荐 temperature 0.9、top_p 1.0。
腾讯官方中国区价格按每百万 tokens 计:缓存命中输入 0.3 元、普通输入 6 元、输出 18 元。英文发布页列出的国际价格分别为 0.042 美元、0.834 美元和 2.501 美元。
腾讯称它仍是早期版本,复杂任务可能思考过久,并有反复检查、过度自我验证的倾向。官方评测也属于厂商自测,实际结果会受到工具、智能体脚手架、超时和采样配置影响。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
