DE
DeepSeek Vision-Language-1.3B-Chat
发布时间: 2024-03-11更新于: 2024-03-11 13:37:26548
模型参数
13亿
上下文长度
4K
中文支持
支持
推理能力
DeepSeek Vision-Language-1.3B-Chat 是由 DeepSeek-AI 发布的 AI 模型,发布时间为 2024-03-11,定位为 多模态大模型,参数规模约为 13亿,上下文长度为 4K,模型文件大小约 2.6GB,采用 DEEPSEEK LICENSE AGREEMENT 许可。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
DeepSeek VL-1.3B-Chat
模型基本信息
推理过程
不支持
思考模式
不支持思考模式
上下文长度
4K tokens
最大输出长度
暂无数据
模型类型
多模态大模型
输入/输出模态
暂无数据
发布时间
2024-03-11
模型文件大小
2.6GB
MoE架构
否
总参数 / 激活参数
13亿 / 不涉及
知识截止
暂无数据
DeepSeek VL-1.3B-Chat
开源和体验地址
DeepSeek VL-1.3B-Chat
官方介绍与博客
DataLearnerAI博客
暂无介绍博客
DeepSeek VL-1.3B-Chat
API接口信息
接口速度
暂无数据
暂无公开的 API 定价信息。
DeepSeek VL-1.3B-Chat
评测结果
当前尚无可展示的评测数据。
和其他模型对比
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
DeepSeek VL-1.3B-Chat
发布机构
DeepSeek-AI
查看发布机构详情 DeepSeek Vision-Language-1.3B-Chat
模型解读
Deepseek Vision-Language-1.3B-Chat简称Deepseek VL-1.3B-Chat,是DeepSeekAI开源的一个多模态大模型,可以理解图片。是一个可以在移动端运行的图片理解的多模态大模型。最高支持384*384分辨率图像的输入,是目前已知的支持最高图像解析度的多模态大模型之一。
Deepseek VL-1.3B-Chat是基于DeepSeek-LLM-1.3B-Chat版本进行训练的,语言模型部分是在5000亿tokens数据集上训练得到,而整个Deepseek VL-1.3B-Base模型则是在4000亿图像-语言tokens数据集上训练得到的。这个版本是指令优化的语言模型基础上拓展而来,支持聊天场景,基础版本的模型参考: https://www.datalearner.com/ai-models/pretrained-models/deepseek-vl-1_3b-base
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
