Gemini 3.7 Flash 是正式版还是预览版?
它是 GA 正式版。官方稳定 API ID 为 gemini-3.7-flash,可用于生产环境。
Gemini 3.7 Flash
Google 于 2026 年 8 月 13 日正式发布的 GA 多模态 Flash 模型:1M 上下文、64K 最大输出,面向复杂编码与多步 Agent 工作流;2026 年底前标准 API 推广价为每百万 tokens 输入 $0.75、输出 $3.75。
数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.750/ 1M | $3.75/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.375/ 1M | $1.88/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $0.375/ 1M | $1.88/ 1M |
| 类型 | 适用条件 | 输入 | 输出 |
|---|---|---|---|
| 文本 | - | $1.35/ 1M | $6.75/ 1M |
| 类型 | 有效期 | 写入 | 读取 |
|---|---|---|---|
| 文本 | - | - | $0.037/ 1M |
Gemini 3.7 Flash 当前已收录的代表性评测结果包括 Terminal-Bench 2.1(8 / 40,得分 85.80)、CharXiv RQ(3 / 13,得分 88.70)、GDM-MRCR v2 (8-needle, 128K)(1 / 4,得分 97)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。
Gemini 3.7 Flash 是 Google 于 2026 年 8 月 13 日正式发布的 GA 多模态推理模型,稳定 API 标识为 gemini-3.7-flash。Google 将其定位为面向编码与智能体工作流的高吞吐量主力模型,重点提升真实软件工程、网页与 UI 生成、复杂知识工作和可靠多步执行。
官方模型页确认其输入上下文上限为 1,048,576 tokens,最大输出为 65,536 tokens;支持文本、图像、视频、音频和 PDF 输入,输出文本。模型支持 low、medium、high 三档 Thinking,默认档为 medium;同时支持函数调用、代码执行、File Search、Google Search 与 Maps grounding、结构化输出、URL Context、上下文缓存及 Computer Use(Preview),并可使用 Batch、Flex 和 Priority 推理。
Google DeepMind 官方模型卡报告:Artificial Analysis Intelligence Index 56、FrontierCode 1.1 Main 43.6%、DeepSWE v1.1 65.3%、Code Arena 1588 Elo、Terminal-Bench 2.1 85.8%、Terminal-Bench 3.0 14.9%、GDPval-AA v2 1525 Elo、GDP.pdf 34.0%、GDM-MRCR v2(128K)97.0%、OSWorld 2.0 47.9% 和 HLE-Verified 53.6%。Google 的评测方法说明,大多数结果使用默认采样设置;DeepSWE 使用 high thinking 和 mini-SWE agent harness,部分工具、联网、帧数及多次运行条件因基准而异。
模型已在 Gemini API、Google AI Studio、Google Antigravity、Gemini Enterprise Agent Platform、Gemini Enterprise 应用和 Gemini Spark 中提供。Gemini Developer API 在 2026 年 12 月 31 日前采用推广价:标准档每百万 tokens 输入 0.75 美元、输出 3.75 美元(包含 thinking tokens),缓存读取 0.075 美元;2027 年 1 月 1 日起分别调整为 1.50、7.50 和 0.15 美元。模型权重未公开,使用时应遵守 Google Gemini API 服务条款。
它是 GA 正式版。官方稳定 API ID 为 gemini-3.7-flash,可用于生产环境。
输入上下文上限为 1,048,576 tokens,最大输出为 65,536 tokens;支持文本、图像、视频、音频和 PDF 输入,输出文本。
支持 low、medium、high 三档,默认是 medium;minimal 不受支持。high 适合最困难的推理、数学、编码和 Agent 任务,但会使用更多 thinking tokens。
2026 年 12 月 31 日前 Standard 推广价为每百万 tokens 输入 $0.75、输出 $3.75、缓存读取 $0.075;2027 年 1 月 1 日起分别调整为 $1.50、$7.50 和 $0.15。
官方模型卡报告 DeepSWE 65.3%、Terminal-Bench 2.1 85.8%、Code Arena 1588 Elo、GDP.pdf 34.0%、GDM-MRCR v2 128K 97.0%、OSWorld 2.0 47.9% 和 HLE-Verified 53.6% 等成绩。
不开源。Google 未公开模型权重、总参数量或激活参数量;该模型通过 Gemini API 和 Google 产品提供。
欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送
