谷歌新一代开放模型Gemma:轻量级、先进、负责任的AI开发新选择
在人工智能(AI)的浪潮中,开放模型的创新和普及对推动技术进步和应用开发至关重要。谷歌一直是这一领域的先驱,其发布的Transformers、TensorFlow、BERT等技术已经成为AI研究和开发的基石。今天,我们将介绍谷歌最新发布的Gemma系列开放模型,这是一套轻量级、先进且设计用来负责任地构建AI应用的模型。
Gemma开放模型简介
Gemma模型是由谷歌DeepMind团队及谷歌其他团队共同开发的,它借鉴了谷歌先前的Gemini模型,并以拉丁语“宝石”之意命名,象征着它在AI领域的珍贵价值。Gemma模型不仅包括模型权重,还提供了一系列工具,以支持开发者的创新、促进合作并指导模型的负责任使用。
Gemma模型的关键信息
- 模型版本:Gemma 2B和Gemma 7B,分别提供预训练和指令调优变体。
- 工具链支持:支持JAX、PyTorch和TensorFlow的原生Keras 3.0,覆盖所有主要框架。
- 易用性:提供了Colab和Kaggle笔记本,以及与Hugging Face等流行工具的集成。
- 部署便捷:可在笔记本电脑、工作站或Google Cloud上运行,并支持在Vertex AI和Google Kubernetes Engine (GKE)上轻松部署。
- 跨平台优化:优化了多个AI硬件平台的性能,包括NVIDIA GPU和Google Cloud TPU。
- 使用条款:允许所有规模的组织负责任地进行商业使用和分发。
Gemma模型性能
Gemma模型在技术和基础设施组件上与谷歌最大的AI模型Gemini保持一致,这使得Gemma 2B和7B在其大小范围内实现了业界领先的性能。Gemma模型能够直接在开发者的笔记本电脑或桌面电脑上运行,并且在关键基准测试中超越了体量更大的模型,同时遵循了严格的安全和负责任的输出标准。
Gemma模型的负责任设计
Gemma模型的设计以谷歌的AI原则为先导。为了确保预训练模型的安全可靠,谷歌采用自动化技术过滤掉训练集中的某些个人信息和其他敏感数据。此外,通过广泛的微调和人类反馈的增强学习(RLHF),以使指令调优模型与负责任的行为保持一致。为了了解并降低Gemma模型的风险概况,谷歌进行了包括手动红队测试、自动对抗测试和危险活动能力评估在内的全面评估。
Gemma模型的优化和工具支持
- 多框架工具:支持多种框架,包括Keras 3.0、PyTorch、JAX和Hugging Face Transformers。
- 跨设备兼容性:Gemma模型可在笔记本电脑、桌面电脑、物联网、移动设备和云端运行。
- 尖端硬件平台:与NVIDIA合作,优化了Gemma模型在NVIDIA GPU上的性能。
- 针对Google Cloud的优化:Vertex AI提供广泛的MLOps工具集,并支持使用内置的推理优化进行一键部署。
研究和开发的免费信用
Gemma模型为开发者和研究人员提供了免费的Kaggle访问权限、Colab笔记本的免费层次,以及首次Google Cloud用户的300美元信用额度。研究人员还可以申请高达500,000美元的Google Cloud信用额度,以加速他们的项目。
如何开始使用Gemma
您可以在ai.google.dev/gemma上了解更多关于Gemma的信息,并访问快速入门指南。
随着Gemma模型家族的不断扩展,我们期待在未来几周内推出新的变体,并为各种应用提供支持。敬请关注即将到来的活动和机会,与Gemma一起连接、学习和构建。
我们很期待看到您使用Gemma创造的成果!
Gemma模型参数表格
| 参数 | Gemma 2B | Gemma 7B |
|---|---|---|
| 模型权重 | 预训练和指令调优变体 | 预训练和指令调优变体 |
| 支持框架 | JAX, PyTorch, TensorFlow (Keras 3.0) | JAX, PyTorch, TensorFlow (Keras 3.0) |
| 部署平台 | 笔记本电脑, 工作站, Google Cloud, Vertex AI, GKE | 笔记本电脑, 工作站, Google Cloud, Vertex AI, GKE |
| 硬件平台优化 | NVIDIA GPU, Google Cloud TPU | NVIDIA GPU, Google Cloud TPU |
| 商业使用和分发 | 允许 | 允许 |