DataLearner 标志
MI

Mistral NeMo-Instruct-12B

基础大模型Mistral

Mistral NeMo-Instruct 12B

发布时间: 2024-07-18更新于: 2024-07-20浏览量: 594
在线体验GitHubHugging Face对比
模型参数
120亿
上下文长度
128K
多语言支持
暂无数据
推理能力
暂无数据

Mistral NeMo-Instruct 12B 是由 MistralAI 发布的 AI 模型,发布时间为 2024-07-18,定位为 基础大模型,参数规模约为 120亿,上下文长度为 128K,模型文件大小约 24.51GB,采用 Apache 2.0 许可,在 Creative Writing 上取得 879.10 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Mistral NeMo-Instruct-12B

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
基础大模型
输入/输出模态
暂无数据
发布时间
2024-07-18
模型文件大小
24.51GB
MoE架构
总参数 / 激活参数
120亿 / 不适用
知识截止
暂无数据
Mistral NeMo-Instruct-12B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
在线体验
暂无
Mistral NeMo-Instruct-12B

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
Mistral NeMo-Instruct-12B

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.020/ 1M tokens$0.040/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Mistral NeMo-Instruct-12B

评测结果

Mistral NeMo-Instruct-12B 当前已收录的代表性评测结果包括 Creative Writing(91 / 106,得分 879.10)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

写作和创作

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
879.10
91 / 106
Mistral NeMo-Instruct-12B

发布机构

Mistral NeMo-Instruct 12B

模型解读

Mistral NeMo-Instruct-12B是MistralAI开源的最新的120亿参数规模的大语言模型,是其开源的70亿参数规模的Mistral 7B模型的继任者,Mistral NeMo-Instruct-12B是指令微调的版本。这意味着未来MistralAI可能不再会开源Mistral 7B,而是用Mistral Nemo代替。

尽管该模型在MMLU得分上没有很突出,但是在推理等任务的表现上效果很好。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码