DataLearner 标志
YI

Yi-9B

基础大模型

Yi-9B

发布时间: 2024-03-06更新于: 2024-03-06浏览量: 539
模型参数
90亿
上下文长度
4K
多语言支持
支持
推理能力
暂无数据

Yi-9B 是由 零一万物 发布的 AI 模型,发布时间为 2024-03-06,定位为 基础大模型,参数规模约为 90亿,上下文长度为 4K,模型文件大小约 18,采用 Yi Series Models License Agreement 许可。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Yi-9B

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
4K tokens
最大输出长度
暂无数据
模型类型
基础大模型
输入/输出模态
暂无数据
发布时间
2024-03-06
模型文件大小
18
MoE架构
总参数 / 激活参数
90亿 / 不适用
知识截止
暂无数据
Yi-9B

开源和体验地址

代码开源状态
预训练权重开源
GitHub 源码
在线体验
暂无
Yi-9B

官方介绍与博客

Yi-9B

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Yi-9B

发布机构

Yi-9B

模型解读

Yi-9B是李开复旗下零一万物最新开源的大语言模型。参数规模90亿,该模型是Yi-6B继续在0.8万亿tokens数据上训练得到。它更加擅长数学和代码生成能力。

与其它70亿参数规模的模型相比(如Mistral-7B、Gemma-7B等),它的数学和代码能力更强。在不牺牲理解能力的基础上,数学推理和代码能力相比Yi-6B都有较大的提升。

根据DataLearnerAI收集的资料,在70亿参数规模的模型综合能力对比中,Yi-9B模型的MMLU评测结果很优秀,而GSM8K和Math这类数学推理能力虽然比Yi-6B有提升,但是相比较Gemma 7B和ChatGLM3-6B,则没有明显的提升。

数据来源: https://www.datalearner.com/ai-models/llm-evaluation?modelSize=7b 

但是代码能力方面,Yi-9B的表现则好很多。

数据来源: https://www.datalearner.com/ai-models/llm-coding-evaluation?modelSize=7b 

相比较同级别的模型,Yi-9B表现好很多。也就是说Yi-9B属于综合能力不错,在代码方面有着很不错表现的大模型。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码