DataLearner 标志
GE

Gemma 4 31B

聊天大模型函数调用GemmaGemma 4

Google Gemma 4 31B

发布时间: 2026-04-02更新于: 2026-08-23知识截止: 2025-01浏览量: 2,287
模型参数
307亿
上下文长度
256K
多语言支持
暂无数据
推理能力
暂无数据

Google DeepMind 于 2026 年 4 月 2 日发布的 Gemma 4 系列旗舰稠密型号,30.7B 参数全激活、60 层稠密 Transformer,256K 上下文、32K 最大输出,Apache 2.0 许可,基于 Gemini 3 同源技术构建,支持 140 多种语言。官方模型卡记录其接受文本和图像输入并输出文本(视频通过图像帧序列处理,不单列为原生模态),支持可切换思考模式,并原生支持函数调用、结构化 JSON 输出和系统指令。部署门槛是它的核心优势:未量化 bfloat16 权重可在单张 80GB H100 上运行,量化后能落到消费级显卡。在 Arena AI 开源排行榜中位列第三、Elo 1452,以约 1/30 的参数媲美 600B 级别模型。相比前代 Gemma 3 27B 是代际跨越——AIME 2026 从 20.8% 提升到 89.2%,LiveCodeBench 从 29.1% 提升到 80.0%。库内实测 MMLU Pro 85.20 在 133 个模型中排第 25,LiveCodeBench 80 排 126 个第 32;但 HLE 19.50 排 181 个第 129,硬核难题仍是小模型的边界。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Gemma 4 31B

模型基本信息

推理过程
支持
思考模式
思考模式 (默认)常规模式
上下文长度
256K tokens
最大输出长度
32K tokens
模型类型
聊天大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-04-02
模型文件大小
暂无数据
MoE架构
否
总参数 / 激活参数
307亿 / 不适用
知识截止
2025-01
Gemma 4 31B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
Gemma 4 31B

官方介绍与博客

Gemma 4 31B

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Gemma 4 31B

评测结果

Gemma 4 31B 当前已收录的代表性评测结果包括 MMLU-Pro(26 / 175,得分 85.20)、LiveCodeBench(33 / 125,得分 80)、Terminal Bench Hard(67 / 244,得分 36.40)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合知识考试

共 3 项评测
评测名称 / 模式
得分
排名/总数
MMLU-Pro
思考模式
85.20
26 / 175
HLE
思考模式
19.50
158 / 235
HLE
思考模式工具联网
26.50
129 / 235

科学知识与推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
思考模式
84.30
96 / 253
CritPt
思考模式
1.40
139 / 204

算法与竞赛编程

共 2 项评测
评测名称 / 模式
得分
排名/总数
CodeForces
思考模式
2150
14 / 21
LiveCodeBench
思考模式
80
33 / 125

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1368.20
70 / 110

客服与业务流程

共 3 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench
思考模式工具
76.90
20 / 44
τ³-Banking
常规模式工具
8.90
140 / 167
τ³-Banking
思考模式工具
14.80
113 / 167

跨能力综合测试

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveBench
常规模式
61.62
64 / 117

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
Terminal Bench Hard
常规模式工具
30.30
110 / 244
Terminal Bench Hard
思考模式工具
36.40
67 / 244

数学

共 1 项评测
评测名称 / 模式
得分
排名/总数
AIME 2026
思考模式
89.20
26 / 30

图像感知与视觉推理

共 4 项评测
评测名称 / 模式
得分
排名/总数
MathVision
思考模式
85.60
9 / 12
MMMU-Pro
常规模式
70.30
128 / 229
MMMU-Pro
思考模式
73.40
109 / 229
MMMU-Pro
unknown
76.90
71 / 229

长文定位与检索

共 1 项评测
评测名称 / 模式
得分
排名/总数
66.40
5 / 8

科学计算与科研编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SciCode
思考模式
45.50
91 / 134

法律

共 1 项评测
评测名称 / 模式
得分
排名/总数
Harvey Lab-AA
思考模式工具
47.23
40 / 44

文档与图表理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDP.pdf
思考模式
6
95 / 122

跨应用与工具编排

共 1 项评测
评测名称 / 模式
得分
排名/总数
52.66
38 / 45

和其他模型对比

Gemma 4 31B

发布机构

Google Gemma 4 31B

模型解读

Gemma 4 31B 是 Google DeepMind 于 2026 年 4 月发布的 30.7B 参数稠密开放权重模型,支持 256K 上下文和可切换的思考模式。

官方模型卡记录其接受文本和图像输入并输出文本;视频通过图像帧序列处理,不单列为原生输入模态。页面保留官方评测,未把免费试用或自托管成本写成一方 API token 价格。

Gemma 4 31B

常见问题

Gemma 4 31B 是什么模型?

Gemma 4 31B 是DeepMind于 2026-04-02 发布的聊天大模型。支持文本、图像输入和文本输出,上下文窗口为 256K,主要能力包括推理大模型。页面已收录官方资料、公开评测,便于核对规格和使用成本。

Gemma 4 31B 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Gemma 4 31B 的上下文窗口和最大输出是多少?

上下文窗口为 256K,最大输出为 32K。未公开或无法确认的规格不做推测。

Gemma 4 31B 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型相关任务;实际效果应结合具体工作流验证。

Gemma 4 31B 是否开源?

代码与模型权重按 Apache 2.0 记录;使用前仍应核对官方许可原文。

Is Gemma 4 31B open source?

The checkpoint is listed under the Apache 2.0 license, with the license link included in the model references. Review the linked license text before commercial or derivative use.

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码