DataLearner 标志
KI

Kimi k1.5 (Short-CoT)

推理大模型Kimi k1Kimi k1.5

Kimi k1.5 (Short-CoT)

发布时间: 2025-01-22更新于: 2025-02-15 19:45:23961
在线体验GitHubHugging FaceCompare
模型参数
未披露
上下文长度
128K
中文支持
支持
推理能力

Kimi k1.5 (Short-CoT) 是由 Moonshot AI 发布的 AI 模型,发布时间为 2025-01-22,定位为 推理大模型,上下文长度为 128K,采用 不开源 许可,在 MATH-500 上取得 94.60 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Kimi k1.5 (Short-CoT)

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
暂无数据
发布时间
2025-01-22
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不涉及
知识截止
暂无数据
Kimi k1.5 (Short-CoT)

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
Hugging Face
暂无开源HuggingFace地址
在线体验
暂无在线体验地址
Kimi k1.5 (Short-CoT)

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
Kimi k1.5 (Short-CoT)

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Kimi k1.5 (Short-CoT)

评测结果

Kimi k1.5 (Short-CoT) 当前已收录的代表性评测结果包括 MMLU(24 / 66,得分 87.40)、MATH-500(26 / 44,得分 94.60)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
87.40
24 / 66

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
94.60
26 / 44

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

Kimi k1.5 (Short-CoT)

发布机构

Kimi k1.5 (Short-CoT)

模型解读

Kimi 1.5月之暗面(Kimi)团队发布的一款多模态推理大语言模型,旨在通过强化学习(RL)和多模态数据处理,提升推理能力。Kimi 1.5有多个版本,其中Short-CoT(短链式推理)模型以高效和精简的推理能力脱颖而出。

Short-CoT模型特点

Kimi 1.5 Short-CoT版本专注于快速、简洁的推理,在计算资源有限的场景下表现优异。相比其他更复杂的版本,Short-CoT模型在推理步骤上进行了优化,减少了上下文窗口的长度,重点解决简单和中等复杂度的任务。

  1. 高效推理:通过强化学习和课程采样,模型从简单任务逐步过渡到复杂任务,确保训练过程高效并且避免了过度计算。
  2. 多模态处理:不仅处理文本数据,Short-CoT还能够处理视觉任务,适应需要图文结合的推理任务,例如MathVistaMMMU等。
  3. 推理简化:通过长度惩罚机制,模型避免了冗长推理,确保在最短时间内给出准确答案。

基准测试结果

Kimi 1.5 Short-CoT在多个标准基准测试中的表现非常出色:

  • MATH-500:得分94.6,显示出强大的数学推理能力。
  • AIME 2024Pass@1得分60.8,在数学挑战中优于多数同类模型。
  • HumanEval-MulPass@1得分81.5,在编程任务中表现出色。

Claude 3.5GPT-4o等主流模型相比,Kimi 1.5 Short-CoT在多个任务中提供了更高的准确性和更快的推理速度。

应用前景

由于其高效的推理和跨模态能力,Kimi 1.5 Short-CoT非常适合应用于需要快速响应的领域,如客户服务教育辅导编程调试等场景。

结语

Kimi 1.5 Short-CoT结合了强化学习和优化的推理策略,在保证性能的同时,大幅提升了计算效率。其在推理准确性、速度和多模态能力上的优势,使其成为未来AI应用的理想选择。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码