DataLearner 标志

Mistral Medium 3.5vsGemma 4 31B

在 3 个共同 benchmark 中,Gemma 4 31B 整体领先:Mistral Medium 3.5 领先 1 项,Gemma 4 31B 领先 2 项,持平 0 项,平均分差 +4.25。

MistralAI
Mistral Medium 3.5

MistralAI · 2026-05-01 · 聊天大模型

DeepMind
Gemma 4 31B

DeepMind · 2026-04-02 · 聊天大模型

Mistral Medium 3.51 (33%)(67%)2 Gemma 4 31B

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

Coding and Software Engineer

Gemma 4 31B 领先 1/1
评测项Mistral Medium 3.5Gemma 4 31B分差
SciCode39.58104 / 130Thinking (No Tools)45.5087 / 130Thinking (No Tools)-5.92

Multimodal Understanding

Gemma 4 31B 领先 1/1
评测项Mistral Medium 3.5Gemma 4 31B分差
GDP.pdf2.80102 / 118Thinking (No Tools)691 / 118Thinking (No Tools)-3.20

Productivity Knowledge

Mistral Medium 3.5 领先 1/1
评测项Mistral Medium 3.5Gemma 4 31B分差
Harvey Lab-AA69.1034 / 43Thinking (With Tools)47.2340 / 43Thinking (With Tools)+21.87

规格对比

字段Mistral Medium 3.5Gemma 4 31B
发布机构MistralAIDeepMind
发布时间2026-05-012026-04-02
模型类型聊天大模型聊天大模型
架构稠密模型稠密模型
参数规模暂无数据307亿
上下文长度暂无数据256K
最大输出暂无数据32K

小结

  • Mistral Medium 3.5在以下类目领先:Productivity Knowledge (1/1)
  • Gemma 4 31B在以下类目领先:Coding and Software Engineer (1/1)、Multimodal Understanding (1/1)

3 个共同 benchmark 上,Mistral Medium 3.5 平均高出 4.25 分。

单项差距最大的 benchmark:Harvey Lab-AA — Mistral Medium 3.5 69.10,Gemma 4 31B 47.23(分差 +21.87)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。