DataLearner 标志
GR

Grok 4.6

编程大模型Grok 4

Grok 4.6

发布时间: 2026-08-12更新于: 2026-08-13 10:32:10.921知识截止: 2026-02-0127
在线体验GitHubHugging FaceCompare
模型参数
未披露
上下文长度
500K
中文支持
不支持
推理能力

Grok 4.6 是 SpaceXAI 于 2026 年 8 月 12 日发布的旗舰模型,重点增强长周期 Agent、编程、知识工作和交互式视觉项目,支持文本与图像输入、500K 上下文、函数调用、联网搜索、代码执行,以及 low/medium/high/xhigh 四档推理。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Grok 4.6

模型基本信息

推理过程
支持
思考模式
思考水平 · 高 (High) (默认)思考水平 · 低 (Low)思考水平 · 中 (Medium)思考水平 · 极高 (Extra-High)
上下文长度
500K tokens
最大输出长度
暂无数据
模型类型
编程大模型
输入/输出模态
文本、图像 → 文本
发布时间
2026-08-12
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不涉及
知识截止
2026-02-01
Grok 4.6

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无GitHub开源地址
Hugging Face
暂无开源HuggingFace地址
在线体验
Grok 4.6

官方介绍与博客

DataLearnerAI博客
暂无介绍博客
Grok 4.6

API接口信息

接口速度
4/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本上下文长度 < 200000$2.00/ 1M$6.00/ 1M
文本上下文长度 >= 200000, 上下文长度 <= 500000$4.00/ 1M$12.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本--$0.500/ 1M
上下文长度 < 200000
文本--$1.00/ 1M
上下文长度 >= 200000, 上下文长度 <= 500000
Grok 4.6

评测结果

Grok 4.6 当前已收录的代表性评测结果包括 AA Intelligence Index(1 / 4,得分 61)、GDPval-AA v2(2 / 7,得分 1753)、DeepSWE(8 / 21,得分 65.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

编程与软件工程

共 4 项评测
评测名称 / 模式
得分
排名/总数
69.90
1 / 1
DeepSWE
工具
65.90
8 / 21
61.30
1 / 1
APEX-SWE
工具
56.40
1 / 1

综合评估

共 1 项评测
评测名称 / 模式
得分
排名/总数
61
1 / 4

生产力知识

共 3 项评测
评测名称 / 模式
得分
排名/总数
GDPval-AA v2
工具
1753
2 / 7
AA-Briefcase
工具
1577
2 / 3
Harvey Lab-AA
工具
15.80
2 / 2

Agent能力评测

共 1 项评测
评测名称 / 模式
得分
排名/总数
APEX-Agents
工具
57.50
1 / 2

AI Agent - 工具使用

共 1 项评测
评测名称 / 模式
得分
排名/总数
26
1 / 1

和其他模型对比

暂时没有为该模型整理的相关对比页面。

想自定义其他组合?打开对比工具

Grok 4.6

发布机构

Grok 4.6

模型解读

Grok 4.6 是 SpaceXAI 于 2026 年 8 月 12 日发布的旗舰模型,在 Grok 4.5 基础上重点增强长周期 Agent、编程、知识工作以及交互式和视觉项目。模型已在 SpaceXAI API、Grok Build、Cursor、OpenRouter、Vercel 和 Cloudflare 提供。DataLearner 当前机构目录沿用 xAI 名称,本条目按该目录归档。


模型能力与规格

官方开发者文档显示,API 模型名为 grok-4.6,支持 Responses API 与 Chat Completions。模型接受文本和图像输入并输出文本,上下文窗口为 500,000 tokens,知识截止日期为 2026 年 2 月 1 日,官方标注无文本输出长度上限。推理强度通过 reasoning_effort 配置,支持 low、medium、high 和 xhigh 四档并默认 high。工具能力包括函数调用、Web 搜索、X 搜索和代码执行,并支持结构化输出。


训练与 Agent 能力

SpaceXAI 表示,Grok 4.6 进行了比 Grok 4.5 更长的补充训练,加入模型生成的推理和高级技术概念数据、高质量工程数据,并改进优化器与训练配方;SFT 轨迹覆盖 STEM、软件工程和知识工作,强化学习则覆盖通用编程、知识工作、内核优化、Web 开发和计算机辅助设计等 Agent 环境。官方强调模型更擅长跨多步骤持续工作,并在较长轨迹中表现出更多自测与验证行为。


官方发布评测

在官方发布页列出的 Grok 4.6 High 成绩中,AA Intelligence Index 为 61、GDPVal-AA v2 为 1753、CursorBench v3.2 为 69.9%、DeepSWE v1.1 为 65.9%、FrontierCode v1.1 Extended 为 61.3%、APEX-Agents 为 57.5%、Terminal-Bench v3.0 为 26.0%、APEX-SWE 为 56.4%、AA-Briefcase 为 1577、Harvey LAB 为 15.8%。这些基准的任务集、Agent harness、工具权限和计分尺度不同,不应脱离各自测试条件直接横向比较。


价格与访问

官方价格表按提示长度分段计费。低于 200K tokens 时,每 100 万 tokens 的输入、缓存输入和输出价格分别为 2.00、0.50 和 6.00 美元;达到或超过 200K tokens 时分别为 4.00、1.00 和 12.00 美元。发布页另称存在两倍价格的快速变体,但当前官方模型目录未列出独立的 fast API 模型名,因此本条目只录入 grok-4.6 标准价格。模型权重、参数规模与训练细节未完整公开。

Grok 4.6

常见问题

Grok 4.6 适合哪些场景?

官方将其定位于编程、Agentic 任务和知识工作,尤其强调长周期研究、跨代码库工作、信息分析,以及把产品想法持续实现并迭代为交互式应用或工作成果。

Grok 4.6 支持多长的上下文和哪些输入?

官方文档列出的上下文窗口为 500,000 tokens,支持文本和图像输入、文本输出,知识截止日期为 2026 年 2 月 1 日,并标注无文本输出长度上限。

Grok 4.6 支持哪些推理档位和工具?

reasoning_effort 支持 low、medium、high、xhigh 四档,默认 high。官方 API 文档列出的工具包括函数调用、Web 搜索、X 搜索和代码执行,并支持结构化输出。

Grok 4.6 的 API 价格是多少?

提示低于 200K tokens 时,每 100 万 tokens 输入 2 美元、缓存输入 0.5 美元、输出 6 美元;达到或超过 200K 时分别为 4、1 和 12 美元。发布页还提到两倍价格的快速变体,但官方模型目录当前没有列出独立 fast API 名称。

Grok 4.6 的官方评测成绩如何?

官方发布页报告 Grok 4.6 High 的 AA Intelligence Index 为 61、GDPVal-AA v2 为 1753、CursorBench 3.2 为 69.9%、DeepSWE 1.1 为 65.9%、FrontierCode 1.1 Extended 为 61.3%,并同时公布了 APEX-Agents、Terminal-Bench 3.0、APEX-SWE、AA-Briefcase 和 Harvey LAB 成绩。

Grok 4.6 是否开源?

目前未公开模型权重或参数规模;模型可通过 SpaceXAI API、Grok Build、Cursor 以及官方列出的模型网关使用。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码