LLaMA Pro - 8B
发布时间: 2024-01-04
不支持
4K tokens
基础大模型
2024-01-04
16.72GB
输入不支持
输入不支持
输入不支持
输入不支持
输入不支持
输出不支持
输出不支持
输出不支持
输出不支持
输出不支持
LLaMA Pro - 8B是腾讯ARC实验室提出的一种大模型微调的方法。相比较传统的有监督微调方法,这个方法可以更好地解决微调的知识遗忘问题。
相比较原始的Llama2-7B,LLaMA Pro - 8B增加了13亿的参数,但是效果好很多:
关注DataLearnerAI微信公众号,接受最新大模型资讯