大模型的发展速度很快,对于需要学习部署使用大模型的人来说,显卡是一个必不可少的资源。使用公有云租用显卡对于初学者和技术验证来说成本很划算。DataLearnerAI在此推荐一个国内的合法的按分钟计费的4090显卡公有云服务提供商仙宫云,可以按分钟租用24GB显存的4090显卡公有云实例,非常具有吸引力~
华盛顿大学提出QLoRA及开源预训练模型Guanaco:将650亿参数规模的大模型微调的显存需求从780G降低到48G!单张显卡可用!
未经证实的GPT-4技术细节,关于GPT-4的参数数量、架构、基础设施、训练数据集、成本等信息泄露,仅供参考
Google发布面试辅助工具Interview Warmup帮助我们理解谷歌面试内容
全球最大的39亿参数的text-to-image预训练模型发布
解决大语言模型的长输入限制:MetaAI发布MegaByte最高支持几百万上下文输入!
2022年必读的AI论文——100个AI领域被引最多的论文分析
马斯克的X.AI平台即将发布的大模型Grōk AI有哪些能力?新消息泄露该模型支持2.5万个字符上下文!
如何构建下一代机器翻译系统——Building Machine Translation Systems for the Next Thousand Languages