DataLearner 标志
YI

Yi-VL-6B

多模态大模型

Yi Visual Language - 6B

发布时间: 2024-01-22更新于: 2024-01-28浏览量: 556
模型参数
60亿
上下文长度
2K
多语言支持
支持
推理能力
暂无数据

Yi Visual Language - 6B 是由 零一万物 发布的 AI 模型,发布时间为 2024-01-22,定位为 多模态大模型,参数规模约为 60亿,上下文长度为 2K,模型文件大小约 12.35GB,采用 Yi Series Models License Agreement 许可,在 MMMU 上取得 39.10 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Yi-VL-6B

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
2K tokens
最大输出长度
暂无数据
模型类型
多模态大模型
输入/输出模态
暂无数据
发布时间
2024-01-22
模型文件大小
12.35GB
MoE架构
总参数 / 激活参数
60亿 / 不适用
知识截止
暂无数据
Yi-VL-6B

开源和体验地址

预训练权重开源
在线体验
暂无
Yi-VL-6B

官方介绍与博客

官方论文
暂无
DataLearnerAI博客
暂无
Yi-VL-6B

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Yi-VL-6B

评测结果

Yi-VL-6B 当前已收录的代表性评测结果包括 MMMU(71 / 74,得分 39.10)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

多模态理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
MMMU
unknown
39.10
71 / 74
Yi-VL-6B

发布机构

Yi Visual Language - 6B

模型解读

Yi-VL-6B全称是Yi Visual Language - 6B的简称,是一个多模态大模型,该模型是基于LLaVA架构完成的。该模型可以接受文本和图片的输入,但是可以返回文本结果。

Yi-VL-6B支持中英文两种语言,可以做图片的理解和文本的识别。根据官方的描述,这个模型可以用来抽取、组织并总结图片中的信息。最高支持448×448像素的图片输入。

该模型实测:

除了60亿参数模型外,还有340亿参数的Yi-VL-34B,这个模型取得了目前多模态评测榜单第一。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码