DataLearner 标志
GE

Gemma 4 31B

聊天大模型函数调用GemmaGemma 4

Google Gemma 4 31B

发布时间: 2026-04-02更新于: 2026-08-23知识截止: 2025-01浏览量: 2,229
模型参数
307亿
上下文长度
256K
多语言支持
暂无数据
推理能力
暂无数据

Google DeepMind 于 2026 年 4 月 2 日发布的 Gemma 4 系列旗舰稠密型号,30.7B 参数全激活、60 层稠密 Transformer,256K 上下文、32K 最大输出,Apache 2.0 许可,基于 Gemini 3 同源技术构建,支持 140 多种语言。官方模型卡记录其接受文本和图像输入并输出文本(视频通过图像帧序列处理,不单列为原生模态),支持可切换思考模式,并原生支持函数调用、结构化 JSON 输出和系统指令。部署门槛是它的核心优势:未量化 bfloat16 权重可在单张 80GB H100 上运行,量化后能落到消费级显卡。在 Arena AI 开源排行榜中位列第三、Elo 1452,以约 1/30 的参数媲美 600B 级别模型。相比前代 Gemma 3 27B 是代际跨越——AIME 2026 从 20.8% 提升到 89.2%,LiveCodeBench 从 29.1% 提升到 80.0%。库内实测 MMLU Pro 85.20 在 133 个模型中排第 25,LiveCodeBench 80 排 126 个第 32;但 HLE 19.50 排 181 个第 129,硬核难题仍是小模型的边界。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Gemma 4 31B

模型基本信息

推理过程
支持
思考模式
思考模式 (默认)常规模式
上下文长度
256K tokens
最大输出长度
32K tokens
模型类型
聊天大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-04-02
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
307亿 / 不适用
知识截止
2025-01
Gemma 4 31B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
Gemma 4 31B

官方介绍与博客

Gemma 4 31B

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
Gemma 4 31B

评测结果

Gemma 4 31B 当前已收录的代表性评测结果包括 IF Bench(33 / 282,得分 75.60)、MMLU-Pro(26 / 176,得分 85.20)、LiveCodeBench(53 / 251,得分 80)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合评估

共 7 项评测
评测名称 / 模式
得分
排名/总数
MMLU-Pro
思考模式
85.20
26 / 176
LiveBench
常规模式
61.62
64 / 117
HLE
常规模式
11.80
371 / 565
HLE
思考模式
23.60
265 / 565
HLE
思考模式
19.50
295 / 565
HLE
思考模式工具联网
26.50
239 / 565
CritPt
思考模式
1.40
136 / 201

科学与综合推理

共 2 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
76.30
271 / 463
GPQA Diamond
思考模式
84.30
173 / 463

编程与软件工程

共 3 项评测
评测名称 / 模式
得分
排名/总数
CodeForces
思考模式
2150
14 / 21
LiveCodeBench
思考模式
80
53 / 251
SciCode
思考模式
45.50
88 / 131

Agent能力评测

共 7 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench
思考模式工具
76.90
20 / 44
τ²-Bench - Telecom
常规模式工具
65.50
149 / 264
τ²-Bench - Telecom
思考模式工具
59.90
160 / 264
Terminal Bench Hard
常规模式工具
30.30
110 / 244
Terminal Bench Hard
思考模式工具
36.40
67 / 244
τ³-Banking
常规模式工具
8.90
140 / 167
τ³-Banking
思考模式工具
14.80
113 / 167

指令跟随

共 2 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
常规模式
53.50
144 / 282
IF Bench
思考模式
75.60
33 / 282

长上下文能力

共 1 项评测
评测名称 / 模式
得分
排名/总数
AA-LCR
常规模式
46.70
142 / 171

数学推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
AIME 2026
思考模式
89.20
26 / 30

AI Agent - 工具使用

共 2 项评测
评测名称 / 模式
得分
排名/总数
Terminal-Bench 2.1
常规模式工具
29.20
158 / 194
Terminal-Bench 2.1
思考模式工具
43.40
144 / 194

生产力知识

共 2 项评测
评测名称 / 模式
得分
排名/总数
GDPval-AA v2
常规模式工具
691
103 / 106
Harvey Lab-AA
思考模式工具
47.23
40 / 43

多模态理解

共 5 项评测
评测名称 / 模式
得分
排名/总数
MathVision
思考模式
85.60
9 / 12
MMMU-Pro
常规模式
70.30
128 / 229
MMMU-Pro
思考模式
73.40
109 / 229
MMMU-Pro
unknown
76.90
71 / 229
GDP.pdf
思考模式
6
92 / 119

长上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
66.40
5 / 8

OpenClaw智能体能力综合测评

共 1 项评测
评测名称 / 模式
得分
排名/总数
52.66
38 / 45

和其他模型对比

Gemma 4 31B

发布机构

Google Gemma 4 31B

模型解读

Gemma 4 31B 是 Google DeepMind 于 2026 年 4 月发布的 30.7B 参数稠密开放权重模型,支持 256K 上下文和可切换的思考模式。

官方模型卡记录其接受文本和图像输入并输出文本;视频通过图像帧序列处理,不单列为原生输入模态。页面保留官方评测,未把免费试用或自托管成本写成一方 API token 价格。

Gemma 4 31B

常见问题

Gemma 4 31B 是什么模型?

Gemma 4 31B 是DeepMind于 2026-04-02 发布的聊天大模型。支持文本、图像输入和文本输出,上下文窗口为 256K,主要能力包括推理大模型。页面已收录官方资料、公开评测,便于核对规格和使用成本。

Gemma 4 31B 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Gemma 4 31B 的上下文窗口和最大输出是多少?

上下文窗口为 256K,最大输出为 32K。未公开或无法确认的规格不做推测。

Gemma 4 31B 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型相关任务;实际效果应结合具体工作流验证。

Gemma 4 31B 是否开源?

代码与模型权重按 Apache 2.0 记录;使用前仍应核对官方许可原文。

Is Gemma 4 31B open source?

The checkpoint is listed under the Apache 2.0 license, with the license link included in the model references. Review the linked license text before commercial or derivative use.

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码