MiMo-V2.6-Pro 开源吗?
开源。小米于 2026 年 9 月 21 日以 MIT 许可在 Hugging Face 发布权重(XiaomiMiMo/MiMo-V2.6-Pro-RL)。
MiMo-V2.6-Pro
别名:MiMo-V2.6-Pro-RL
MiMo-V2.6-Pro 是小米 2026 年 9 月发布并以 MIT 许可开源的旗舰全模态推理模型,稀疏 MoE 架构总参数 1.02 万亿、激活 420 亿,支持文本/图像/视频/音频输入与 1M 上下文,DeepSWE v1.1 得分 71.9。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥3.00/ 1M tokens | ¥6.00/ 1M tokens |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.435/ 1M tokens | $0.870/ 1M tokens |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | — | $0.0036/ 1M tokens |
| 文本 | - | — | ¥0.025/ 1M tokens |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
MiMo-V2.6-Pro 当前已收录的代表性评测结果包括 Terminal-Bench 2.1(5 / 196,得分 89.90)、AutomationBench(2 / 20,得分 53.10)、DeepSWE(14 / 89,得分 71.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
MiMo-V2.6-Pro 是小米 MiMo 团队于 2026 年 9 月发布并开源的旗舰全模态推理模型,是 MiMo-V2.6 系列中能力最强的一款。官方将该系列定位为“把强化学习推向自我改进”的阶段性成果:同时扩展 RL 计算、环境与工具多样性以及 grader compute,在编程、通用 Agent、视觉和网络安全任务上做一次混合强化学习训练,而不是按领域分别训练。
模型采用稀疏 MoE 架构,总参数 1.02 万亿、每 token 激活 420 亿,384 个路由专家中每次激活 8 个;语言主干 70 层(60 层滑动窗口注意力 + 10 层全局注意力),隐藏层维度 6144。模型为原生全模态设计,输入支持文本、图像、视频和音频,输出为文本;上下文窗口 1M tokens。视觉编码器为 681M 参数的 MiMo ViT(28 层,24 层 SWA + 4 层全注意力),音频侧由 308M 的 AudioTokenizer 与 127M 的 audio patch encoder 组成,并带有 5 层 MTP 推测解码器(一次预测 7 个 token)。
小米公布的 MiMo-V2.6-Pro 成绩包括:DeepSWE v1.1 71.9、Toolathlon-Verified 76.9、Terminal Bench 2.1 89.9、Terminal Bench 4.0 34.9、OSWorld-Verified 82.0、JobBench 62.0、Agents' Last Exam 31.6、AutomationBench v1.0.6 53.1、CyberGym 94.0、MiMo Code Bench 63.2、MiMo VisualCoding 72.3、GDPval-AA 2.1 1673。官方评测表同时列出了与 Claude Opus 5、GPT-5.6 Sol 和 Claude Fable 5 的对比。
小米 MiMo 开放平台国内价格为输入 ¥3/百万 tokens、缓存命中输入 ¥0.025/百万 tokens、输出 ¥6/百万 tokens;国际站价格为输入 $0.435、缓存命中 $0.0036、输出 $0.87(均为每百万 tokens),批量推理档另有 5 折。
MiMo-V2.6 系列于 2026 年 9 月 21 日在 Hugging Face 以 MIT 许可开放权重,9 月 22 日在小米 MiMo 开放平台(mimo.mi.com)提供 API 服务,同时可通过 ModelScope、OpenRouter 获取。官方还公开了该系列强化学习后训练的实时面板:Pro 与 Flash 的训练均不到 6 天、各完成 30 步,累计约 75 万条轨迹,成本分别约 262 万美元与 85 万美元(官方口径)。
开源。小米于 2026 年 9 月 21 日以 MIT 许可在 Hugging Face 发布权重(XiaomiMiMo/MiMo-V2.6-Pro-RL)。
稀疏 MoE 架构,总参数 1.02 万亿,每 token 激活 420 亿,384 个路由专家中激活 8 个。
原生支持文本、图像、视频和音频输入,输出为文本,上下文窗口 1M tokens。
国内输入 ¥3/百万 tokens、缓存命中 ¥0.025/百万 tokens、输出 ¥6/百万 tokens;国际站为 $0.435 / $0.0036 / $0.87,批量推理档 5 折。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
