DataLearner 标志
GR

Grok 4

已下架 · 2026-05-15推理大模型Grok 4

Grok 4

发布时间: 2025-07-10更新于: 2026-09-04退役: 2026-05-15浏览量: 4,158
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
256K
多语言支持
支持
推理能力
4/5

Grok 4 是xAI于 2025-07-10 发布的推理大模型。支持文本、图像输入和文本输出,上下文窗口为 256K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Grok 4

模型基本信息

推理过程
支持
思考模式
常规模式 (默认)思考水平 · 深度 (Deep)
上下文长度
256K tokens
最大输出长度
256K tokens
模型类型
推理大模型
输入/输出模态
文本、图像 → 文本
发布时间
2025-07-10
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
暂无数据
Grok 4

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
Grok 4

官方介绍与博客

Grok 4

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$3.00/ 1M tokens$15.00/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Grok 4

评测结果

Grok 4 当前已收录的代表性评测结果包括 AIME2025(14 / 215,得分 98.80)、MMLU Pro(15 / 176,得分 87)、IMO 2024(1 / 10,得分 23.20)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用
联网能力

综合评估

共 9 项评测
评测名称 / 模式
得分
排名/总数
MMLU Pro
思考模式
87
15 / 176
ARC-AGI-1
思考模式
66.70
87 / 147
LiveBench
常规模式
62.02
61 / 117
HLE
思考模式
26.70
234 / 563
HLE
思考模式
25.40
243 / 563
HLE
思考模式工具
38.60
141 / 563
HLE
思考模式工具联网
38.60
141 / 563
ARC-AGI-2
思考模式
15.90
88 / 136
CritPt
思考模式
2
127 / 200

科学与综合推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
思考模式
87
133 / 462

编程与软件工程

共 3 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
思考模式
81.90
44 / 250
SWE-bench Verified
思考模式
58.60
85 / 116
WeirdML v2
常规模式工具
45.73
41 / 52

数学推理

共 9 项评测
评测名称 / 模式
得分
排名/总数
AIME2025
思考模式
91.70
45 / 215
AIME2025
思考模式工具
98.80
14 / 215
IMO-ProofBench
思考模式
46.70
4 / 16
23.30
10 / 16
IMO 2025
思考模式
29.20
1 / 9
IMO 2024
思考模式
23.20
1 / 10
18.60
12 / 24
FrontierMath
常规模式
12.10
22 / 60
2.10
56 / 80

AI Agent - 工具使用

共 1 项评测
评测名称 / 模式
得分
排名/总数
Terminal-Bench
思考模式工具
38
13 / 35

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
思考模式
60.50
33 / 93

Agent能力评测

共 5 项评测
评测名称 / 模式
得分
排名/总数
METR Time Horizons v1.1
常规模式工具
110.07
13 / 22
79.60
7 / 59
τ²-Bench - Telecom
思考模式工具
74.90
125 / 264
BALROG
常规模式工具
43.60
4 / 12
Terminal Bench Hard
思考模式工具
37.90
59 / 244

指令跟随

共 1 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
思考模式
53.70
142 / 282

多模态理解

共 2 项评测
评测名称 / 模式
得分
排名/总数
MMMU-Pro
思考模式
68.80
139 / 227
GeoBench ACW
常规模式
45
20 / 20

长上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
Fiction.liveBench
常规模式
94.40
3 / 16
Grok 4

发布机构

Grok 4

模型解读

-------------2025年8月9日Grok4最新消息------------

1. Grok 4 向免费用户开放(不含联网搜索)

自 2025 年 7 月初起,xAI 发布了升级版 Grok 4,带来了更强的性能、原生工具调用以及实时搜索等功能。此前该版本仅面向付费订阅(如 SuperGrok 或 Premium+)开放,而现在免费用户也可以使用 Grok 4,但不支持联网搜索功能。虽然官方公告细节不多,但已有大量用户反馈这一功能已实际开放

2. PDF 处理能力大幅增强

Grok 4 现在可以轻松处理上百页的大型 PDF 文件,并且在内容识别和理解方面有了显著提升。这项功能在网页端和移动端均可使用,对于研究人员、学生以及需要阅读长文档的专业人士来说是重大利好。

3. Grok Imagine 上线图片与视频生成

在创作能力方面,xAI 将 Grok Imagine 集成到 iOS 与 Android 的 Grok 应用中,带来了一系列视觉生成能力:

  • 支持从文本或图像生成图片和视频
  • 视频最长可达 15 秒,并支持音频同步
  • 提供 普通(Normal)、趣味(Fun)、自定义(Custom)、Spicy(成人) 四种模式
  • 目前在移动端免费向所有用户开放,且使用量激增——单日生成图片 4400 万张,是前一天的两倍

该功能详情参考:  xAI发布Grok Imagine功能,一条文本命令即可生成图片和最长达15秒的视频,也可以基于现有照片生成视频,免费用户也可以使用~ 

---------原始介绍

马斯克旗下大模型企业xAI发布的第四代大模型。各项评测结果都超过了当前现有的大模型,API接口价格和上一代一样,但是网页版不再免费,需要SuperGrok的会员,300美元一年,或者30美元一个月。

Grok 4

常见问题

Grok 4 是什么模型?

Grok 4 是xAI于 2025-07-10 发布的推理大模型。支持文本、图像输入和文本输出,上下文窗口为 256K,主要能力包括推理大模型、多语言。页面已收录官方资料、API 定价、公开评测,便于核对规格和使用成本。

Grok 4 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像输入,并生成文本输出。

Grok 4 的上下文窗口和最大输出是多少?

上下文窗口为 256K,最大输出为 256K。未公开或无法确认的规格不做推测。

Grok 4 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言相关任务;实际效果应结合具体工作流验证。

Grok 4 是否提供 API,价格如何查看?

页面已收录 xAI 的 2 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Grok 4 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码