TU
Turing-NLG
基础大模型Turing Natural Language Generation
发布时间: 2020-02-13更新于: 2023-03-11浏览量: 589
上下文长度
2K
Turing-NLG is the 17B-parameter language model Microsoft announced in February 2020, then the largest published language model. Trained with DeepSpeed and ZeRO, it improved text completion, question answering and summarisation, and was not released publicly.
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
Turing-NLG
模型基本信息
推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
2K tokens
最大输出长度
暂无数据
模型类型
基础大模型
输入/输出模态
暂无数据
发布时间
2020-02-13
模型文件大小
暂无数据
MoE架构
否
总参数 / 激活参数
170亿 / 不适用
知识截止
暂无数据
Turing-NLG
开源和体验地址
代码开源状态
暂无数据
预训练权重开源
暂无数据
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Turing-NLG
官方介绍与博客
官方论文
暂无
DataLearnerAI博客
暂无
Turing-NLG
API接口信息
接口速度
暂无数据
暂无公开的 API 定价信息。
Turing-NLG
发布机构
微软
查看发布机构详情 Turing Natural Language Generation
模型解读
T-NLG是一种基于Transformer的生成式语言模型,它可以生成单词以完成开放式文本任务。除了完成未完成的句子,它还可以生成直接回答问题和输入文档摘要。
生成式模型如T-NLG在NLP任务中非常重要,因为我们的目标是在任何情况下像人类一样直接、准确和流畅地回答。以前,问答和摘要系统依靠从文档中提取已有内容,作为替代答案或摘要,但它们经常显得不自然或不连贯。有了T-NLG,我们可以自然地摘要或回答有关个人文档或电子邮件线程的问题。
我们观察到,模型越大、预训练数据越多样化和全面,它在泛化到多个下游任务时表现越好,即使有更少的训练示例。因此,我们认为训练一个大型集中的多任务模型并共享其能力跨多个任务比为每个任务单独训练一个新模型更有效率。
DataLearner 官方微信
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
