DataLearner 标志
PH

Phi-1.5

基础大模型Phi-1.5

Phi-1.5

发布时间: 2023-09-11更新于: 2023-12-13 13:18:23.160568
在线体验GitHubHugging FaceCompare
模型参数
13亿
上下文长度
2K
中文支持
不支持
推理能力

Phi-1.5 是由 Microsoft Azure 发布的 AI 模型,发布时间为 2023-09-11,定位为 基础大模型,参数规模约为 13亿,上下文长度为 2K,模型文件大小约 2.84GB,采用 Microsoft Research License 许可,在 GSM8K 上取得 40.20 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Phi-1.5

模型基本信息

推理过程
不支持
思考模式
不支持思考模式
上下文长度
2K tokens
最大输出长度
暂无数据
模型类型
基础大模型
输入/输出模态
暂无数据
发布时间
2023-09-11
模型文件大小
2.84GB
MoE架构
总参数 / 激活参数
13亿 / 不涉及
知识截止
暂无数据
Phi-1.5

开源和体验地址

代码开源状态
预训练权重开源
GitHub 源码
暂无GitHub开源地址
在线体验
暂无在线体验地址
Phi-1.5

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
Phi-1.5

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Phi-1.5

评测结果

Phi-1.5 当前已收录的代表性评测结果包括 GSM8K(50 / 70,得分 40.20)、HumanEval(74 / 101,得分 34.10)、MBPP(58 / 70,得分 37.70)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
37.60
118 / 124

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GSM8K
常规模式
40.20
50 / 70

编程与软件工程

共 2 项评测
评测名称 / 模式
得分
排名/总数
MBPP
常规模式
37.70
58 / 70
HumanEval
常规模式
34.10
74 / 101

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

Phi-1.5

发布机构

Phi-1.5

模型解读

Phi-1.5是微软的编程大模型Phi-1的迭代版本。在Phi-1模型中,微软证明了使用教科书般高质量的数据集可以让小规模参数的语言模型拥有很高的编程水平。因此,微软继续尝试。


在Phi-1模型的基础上,微软继续加入新的NLP合成文本数据集来提升模型的语言理解能力,最终得到了Phi-1.5模型。


Phi-1.5与Phi-1一样,只有13亿的参数,但是在多个评测上的效果都远超同类规模的模型。而代码能力降低不高。


而这个参数规模是可以在手机上运行的。


微软还训练了另一个模型phi-1.5-web,加入了部分过滤后的网络语料。结果表明,高质量合成数据的作用远远大于网络语料。



Phi-1模型的简介: https://www.datalearner.com/ai-models/pretrained-models/Phi-1 

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码