MiMo-V2.6-Pro-UltraSpeed 是什么?
它是小米 MiMo 开放平台为 MiMo-V2.6-Pro 提供的高速推理档,官方称输出速度最高提升 20 倍。
MiMo-V2.6-Pro-UltraSpeed
MiMo-V2.6-Pro-UltraSpeed 是小米 MiMo 开放平台为 MiMo-V2.6-Pro 提供的高速推理档,官方称保持 Pro 能力的同时输出速度最高提升 20 倍,价格约为标准档的 10 倍。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | ¥30.00/ 1M tokens | ¥60.00/ 1M tokens |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $4.35/ 1M tokens | $8.70/ 1M tokens |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | — | $0.036/ 1M tokens |
| 文本 | - | — | ¥0.250/ 1M tokens |
表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。
MiMo-V2.6-Pro-UltraSpeed 是小米 MiMo 开放平台为 MiMo-V2.6-Pro 提供的高速推理档,官方称在保持 V2.6-Pro 能力的前提下提供最高 20 倍输出速度,面向实时交互和对时延敏感的生产场景。小米未公布该档位在实现上与标准档的差异,也未单独发布其评测成绩。
能力与 MiMo-V2.6-Pro 一致:稀疏 MoE,总参数 1.02 万亿、激活 420 亿。模型为原生全模态设计,输入支持文本、图像、视频和音频,输出为文本;上下文窗口 1M tokens。视觉编码器为 681M 参数的 MiMo ViT(28 层,24 层 SWA + 4 层全注意力),音频侧由 308M 的 AudioTokenizer 与 127M 的 audio patch encoder 组成,并带有 5 层 MTP 推测解码器(一次预测 7 个 token)。
该档位按高速服务单独计价:国内输入 ¥30/百万 tokens、缓存命中输入 ¥0.25/百万 tokens、输出 ¥60/百万 tokens;国际站为输入 $4.35、缓存命中 $0.036、输出 $8.7(均为每百万 tokens),约为标准档的 10 倍。
MiMo-V2.6 系列于 2026 年 9 月 21 日在 Hugging Face 以 MIT 许可开放权重,9 月 22 日在小米 MiMo 开放平台(mimo.mi.com)提供 API 服务,同时可通过 ModelScope、OpenRouter 获取。官方还公开了该系列强化学习后训练的实时面板:Pro 与 Flash 的训练均不到 6 天、各完成 30 步,累计约 75 万条轨迹,成本分别约 262 万美元与 85 万美元(官方口径)。
它是小米 MiMo 开放平台为 MiMo-V2.6-Pro 提供的高速推理档,官方称输出速度最高提升 20 倍。
国内输入 ¥30/百万 tokens、缓存命中 ¥0.25/百万 tokens、输出 ¥60/百万 tokens;国际站为 $4.35 / $0.036 / $8.7,约为标准档的 10 倍。
没有。小米未单独公布该档位的评测结果,官方口径是在保持 V2.6-Pro 能力的前提下提速。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
