DataLearner 标志
OP

OpenAI o1

预计下架 · 2026-10-23推理大模型o-serieso1

OpenAI o1

发布时间: 2024-12-05更新于: 2026-09-04预计下架: 2026-10-23浏览量: 2,432
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
128K
多语言支持
支持
推理能力
暂无数据

OpenAI o1 是由 OpenAI 发布的 AI 模型,发布时间为 2024-12-05,定位为 推理大模型,上下文长度为 128K,采用 不开源 许可,在 MATH 上取得 96.40 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

OpenAI o1

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
128K tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
暂无数据
发布时间
2024-12-05
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
暂无数据
OpenAI o1

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
OpenAI o1

官方介绍与博客

OpenAI o1

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
OpenAI o1

评测结果

OpenAI o1 当前已收录的代表性评测结果包括 MMLU Pro(1 / 133,得分 91.04)、MMLU(4 / 124,得分 91.80)、MATH(2 / 42,得分 96.40)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合评估

共 3 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
91.80
4 / 124
MMLU Pro
常规模式
91.04
1 / 133
HLE
常规模式
9.10
167 / 189

数学推理

共 4 项评测
评测名称 / 模式
得分
排名/总数
MATH
常规模式
96.40
2 / 42
MATH-500
常规模式
96.40
17 / 44
AIME 2024
常规模式
79.20
31 / 62
9.30
30 / 60

科学与综合推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
77.30
159 / 270

常识问答

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
42.60
19 / 47

编程与软件工程

共 4 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
71
51 / 127
SWE-bench Verified
常规模式
48.90
100 / 115
41
104 / 115
WeirdML v2
工具
43.82
43 / 52

常识推理

共 3 项评测
评测名称 / 模式
得分
排名/总数
36.70
69 / 92
SimpleBench
思考模式
41.70
60 / 92
40.10
65 / 92

Agent能力评测

共 2 项评测
评测名称 / 模式
得分
排名/总数
61.70
19 / 59
39.21
18 / 22

多模态理解

共 2 项评测
评测名称 / 模式
得分
排名/总数
80
8 / 20
VPCT
37
21 / 24

长上下文

共 1 项评测
评测名称 / 模式
得分
排名/总数
83.30
8 / 16
OpenAI o1

发布机构

OpenAI o1

模型解读

OpenAI发布的推理大模型。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码