DataLearner 标志
GR

Grok 3

已下架 · 2026-05-15聊天大模型Grok-3

Grok 3

发布时间: 2025-02-17更新于: 2026-09-18退役: 2026-05-15浏览量: 1,442
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
128K
多语言支持
支持
推理能力
暂无数据

Grok 3 是由 xAI 发布的 AI 模型,发布时间为 2025-02-17,定位为 聊天大模型,上下文长度为 128K,采用 不开源 许可,在 Creative Writing 上取得 1183.50 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Grok 3

模型基本信息

推理过程
暂无数据
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
聊天大模型
输入/输出模态
文本 → 文本
发布时间
2025-02-17
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
Grok 3

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
Grok 3

官方介绍与博客

Grok 3

API接口信息

接口速度
暂无数据
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$3.00/ 1M tokens$15.00/ 1M tokens

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Grok 3

评测结果

Grok 3 当前已收录的代表性评测结果包括 MMMU(22 / 74,得分 78)、AIME 2024(22 / 61,得分 84.20)、LiveCodeBench(92 / 251,得分 70.60)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合知识考试

共 1 项评测
评测名称 / 模式
得分
排名/总数
HLE
常规模式
4.10
525 / 568

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
80.40
232 / 461

事实可靠性与幻觉

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
43.40
18 / 46

数学

共 4 项评测
评测名称 / 模式
得分
排名/总数
AIME 2024
常规模式
84.20
22 / 61
AIME2025
常规模式
77.10
104 / 215
FrontierMath
常规模式
3.80
45 / 60
0
72 / 80

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
70.60
92 / 251

写作与创意表达

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
1183.50
80 / 106

图像感知与视觉推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
MMMU
unknown
78
22 / 74

常识推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleBench
常规模式
36.10
71 / 93

自主开发与终端任务

共 2 项评测
评测名称 / 模式
得分
排名/总数
Aider-Polyglot
常规模式
53.30
30 / 59
Terminal Bench Hard
常规模式工具
11.40
181 / 244

客服与业务流程

共 1 项评测
评测名称 / 模式
得分
排名/总数
τ²-Bench - Telecom
常规模式工具
48.80
175 / 264

指令与格式遵循

共 1 项评测
评测名称 / 模式
得分
排名/总数
IF Bench
常规模式
46.90
171 / 282

跨能力聚合指数

共 1 项评测
评测名称 / 模式
得分
排名/总数
ECI
unknown
138.34
102 / 167
Grok 3

发布机构

Grok 3

模型解读

Grok-3是xAI发布的第三代大语言模型,在2025年2月17日发布。

Grok-3系列模型分为2个版本,分别是Grok-3和Grok-3 mini,官方没有公布参数等信息。这两个版本的模型都支持推理模式,其中Grok-3 mini的Reasoning版本已经训练完成,而Grok-3 Reasoning目前是beta版本,并未正式发布。

关于Grok-3大模型的具体介绍,参考DataLearnerAI的博客: https://www.datalearner.com/blog/1051739847418034 

为了更加清晰对比Grok-3模型和其它模型的对比结果,我们DataLearnerAI汇总了所有的大模型对比,数据来源: https://www.datalearner.com/ai-models/ai-benchmarks-tests/compare-result?benchmarkInputString=37,32&modelInputString=511,510,509,508,501,495,492,488,470,429 

https://www.datalearner.com/ai-models/ai-benchmarks-tests/compare-result?benchmarkInputString=37,32&modelInputString=511,510,509,508,501,495,492,488,470,429

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码