Gemma 3 - 12B (IT) 是什么模型?
Gemma 3 - 12B (IT) 是Google Deep Mind于 2025-03-12 发布的基础大模型。支持文本、图像输入和文本输出,上下文窗口为 128K,主要能力包括多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
Gemma 3 - 12B (IT)
Gemma 3 - 12B (IT) 是Google Deep Mind于 2025-03-12 发布的基础大模型。支持文本、图像输入和文本输出,上下文窗口为 128K,主要能力包括多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.040/ 1M | $0.130/ 1M |
Gemma 3 - 12B (IT) 当前已收录的代表性评测结果包括 MATH(9 / 42,得分 83.80)、MMLU Pro(110 / 132,得分 60.60)、GPQA Diamond(172 / 187,得分 40.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
暂时没有为该模型整理的相关对比页面。
想自定义其他组合?打开对比工具
Gemma 3 - 12B(IT)是Google开源的120亿参数的第三代多模态大模型。IT后缀表明这是一个经过指令微调的版本,即insturction fine-tuned。
关于Gemma 3系列详细介绍参考: https://www.datalearner.com/blog/1051741769941194
Gemma3-12B 是 Google DeepMind 最新发布的 Gemma 3 系列模型之一,相较于 4B 版本,它在参数规模、计算能力和任务表现上进一步提升,同时保持了较好的计算效率。该模型支持 128K tokens 的长上下文处理,集成了 417M 参数的视觉编码器,并采用 知识蒸馏 进行优化,在文本生成、多模态任务和推理能力上展现出优异的性能。
| 模型版本 | 视觉编码器参数 | 嵌入参数 | 非嵌入参数 | 上下文长度 |
|---|---|---|---|---|
| Gemma3‑4B | 417M | 675M | 3209M | 128K tokens |
| Gemma3‑12B | 417M | 1012M | 10759M | 128K tokens |
| Gemma3‑27B | 417M | 1416M | 25600M | 128K tokens |
Gemma3-12B 在计算能力和任务表现上比 4B 版本更强,支持多模态输入,适合需要高效推理和长文本处理的任务,同时比 27B 版本更易部署。适用于 NLP、代码生成、OCR 以及多语言任务,是当前开源 LLM 生态中的重要选择。
Gemma 3 - 12B (IT) 是Google Deep Mind于 2025-03-12 发布的基础大模型。支持文本、图像输入和文本输出,上下文窗口为 128K,主要能力包括多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。
当前官方资料记录其支持文本、图像输入,并生成文本输出。
上下文窗口为 128K。未公开或无法确认的规格不做推测。
根据已收录的官方能力标签,它适合多语言相关任务;实际效果应结合具体工作流验证。
页面已收录 DeepInfra 的 2 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。
代码与模型权重按 Gemma Terms of Use 记录;使用前仍应核对官方许可原文。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
