DataLearner 标志
GE

Gemma 4 120B

未成真基础大模型GemmaGemma 4 120B

Gemma 4 120B

发布时间: 2026-05-19更新于: 2026-08-22浏览量: 1,020
在线体验GitHubHugging Face对比
模型参数
1200亿
上下文长度
128K
多语言支持
暂无数据
推理能力
3/5

社区在 2026 年初讨论的一款可能属于 Gemma 系列下一代的大规模语言模型。截至目前 Google DeepMind 尚未正式发布或确认该模型的存在,也未公开任何官方模型卡、论文或技术报告——相关信息主要来自开发者社区、X 上的模型追踪账号以及对 Google AI 仓库更新的观察。Gemma 是 Google DeepMind 的开放权重模型家族,设计目标是让研究者和开发者在本地或私有环境运行;2024 年首发,此后扩展出 CodeGemma、PaliGemma、MedGemma 和 Gemma 3 等,Gemma 3 于 2025 年发布并提供 1B / 4B / 12B / 27B 多个规模。部分开发者在 X 上提到存在一个约 120B 参数的版本,因此被称为「Gemma 4 120B」,若属实将是 Gemma 首次进入百亿级以上参数层级;但这一规模与命名均未获 Google 官方确认,架构(是否 MoE)、训练数据、上下文窗口和多模态能力等细节全部属于推测。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Gemma 4 120B

模型基本信息

推理过程
暂无数据
思考模式
常规模式 (默认)思考模式
上下文长度
128K tokens
最大输出长度
8K tokens
模型类型
基础大模型
输入/输出模态
文本 → 文本
发布时间
2026-05-19
模型文件大小
暂无数据
MoE架构
是
总参数 / 激活参数
1200亿 / 暂无数据
知识截止
暂无数据
Gemma 4 120B

开源和体验地址

代码开源状态
预训练权重开源
Gemma Terms of Use- 免费商用授权
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Gemma 4 120B

官方介绍与博客

官方论文
暂无
DataLearnerAI博客
暂无
Gemma 4 120B

API接口信息

接口速度
3/5
暂无公开的 API 定价信息。
Gemma 4 120B

发布机构

Gemma 4 120B

模型解读

状态更新(2026-08-26):本版本未成真。Google 从未发布 120B 规模的 Gemma 4。Gemma 4 系列于 2026-04-02 以 Apache 2.0 许可发布,实际仅包含 E2B、E4B、12B、26B A4B、31B 五个尺寸。120B 的说法源自开发者社区与社交媒体上的讨论,Google DeepMind 从未确认或发布该规格。下文保留当时的传闻记录,供追溯判断依据。

Gemma 4 120B 模型概览

Gemma 4 120B 是社区在2026年初讨论的一款可能属于 Gemma 系列下一代模型的大规模语言模型。截至目前,Google DeepMind 尚未正式发布或确认该模型的存在,也未公开任何官方模型卡、论文或技术报告。关于该模型的信息主要来自开发者社区、X(Twitter)上的模型追踪账号以及对 Google AI 仓库更新的观察。

Gemma 系列是 Google DeepMind 发布的开放权重语言模型家族,其设计目标是为研究人员和开发者提供能够在本地或私有环境运行的高效大语言模型。该系列模型最早于 2024 年发布,并逐步扩展出多个规模与衍生模型,例如 CodeGemma、PaliGemma、MedGemma 以及 Gemma 3 等。

Gemma 系列发展背景

Gemma 模型被认为是基于 Google Gemini 系列模型蒸馏或架构经验构建的开放权重模型。Gemma 3 于 2025 年发布,提供 1B、4B、12B 和 27B 等多个参数规模,并在部分版本中引入更长上下文窗口以及视觉理解能力。这些模型被广泛用于本地推理、研究实验以及边缘计算环境。

在此背景下,社区普遍认为 Google 可能会推出新一代 Gemma 系列模型。部分开发者在 X 平台的讨论中提到存在一个规模约为 120B 参数的版本,因此常被称为“Gemma 4 120B”。不过,这一规模和命名方式目前尚未得到 Google 官方确认。

可能的技术定位

根据社区讨论,Gemma 4 120B 可能代表 Gemma 系列首次进入百亿级以上参数规模的大模型层级。如果这一模型确实存在,其定位可能是该系列的旗舰版本,用于提供更强的语言理解、推理能力以及复杂任务处理能力。

需要强调的是,目前关于该模型的具体架构(例如是否采用 Mixture-of-Experts 架构)、训练数据规模、上下文窗口以及多模态能力等信息均未在官方渠道披露。因此,任何关于这些技术细节的描述都仍然属于推测。

发布状态

截至目前公开资料显示,Google DeepMind 官方仅发布到 Gemma 3 系列模型。Gemma 4 以及 120B 参数规模版本尚未在 Google AI 官方文档、技术博客或 Hugging Face 仓库中正式出现。因此,该模型应被视为尚未发布的传闻或开发阶段模型,其最终规格和发布时间仍需等待官方确认。

Gemma 4 120B

常见问题

Gemma 4 120B 是真实存在的模型吗?

尚未得到 Google 官方确认。Google DeepMind 没有正式发布该模型,也没有公开模型卡、论文或技术报告。信息来源是开发者社区讨论、X 上的模型追踪账号以及对 Google AI 仓库更新的观察,属于传闻级别。本站按未发布模型收录,规格字段不做推测填充。

「120B」这个规模是怎么来的?

来自部分开发者在 X 平台的讨论,称存在一个规模约 120B 参数的版本,「Gemma 4 120B」这个叫法也由此而来。这个规模和命名方式都未经 Google 确认。作为参照,已发布的 Gemma 3 最大只到 27B——如果 120B 属实,将是 Gemma 系列首次进入百亿级以上参数层级。

Gemma 系列和 Gemini 是什么关系?

Gemma 被认为是基于 Google Gemini 系列模型蒸馏或架构经验构建的开放权重模型家族,定位是让研究人员和开发者能在本地或私有环境运行的高效模型,与闭源的 Gemini 形成互补。系列自 2024 年发布以来扩展出 CodeGemma、PaliGemma、MedGemma 和 Gemma 3 等分支,广泛用于本地推理、研究实验和边缘计算。

它会采用 MoE 架构吗?上下文多长?

均未披露。具体架构(是否采用 Mixture-of-Experts)、训练数据规模、上下文窗口以及多模态能力等信息都没有在官方渠道公布,任何关于这些细节的描述都属于推测。Gemma 3 的部分版本引入了更长上下文和视觉理解能力,但这不能作为下一代规格的依据。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码