DataLearner 标志
OP

OpenAI o3-mini (high)

推理大模型o Minio3

OpenAI o3-mini (high)

发布时间: 2025-01-31更新于: 2025-02-09浏览量: 1,072
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
128k
多语言支持
支持
推理能力
暂无数据

OpenAI o3-mini (high) 是由 OpenAI 发布的 AI 模型,发布时间为 2025-01-31,定位为 推理大模型,上下文长度为 128k,采用 不开源 许可,在 MATH 上取得 97.90 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

OpenAI o3-mini (high)

模型基本信息

推理过程
支持
思考模式
不支持思考模式
上下文长度
128k tokens
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-01-31
模型文件大小
暂无数据
MoE架构
未公布
总参数 / 激活参数
未公布 / 未公布
知识截止
暂无数据
OpenAI o3-mini (high)

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
在线体验
暂无
OpenAI o3-mini (high)

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
OpenAI o3-mini (high)

API接口信息

接口速度
暂无数据
暂无公开的 API 定价信息。
OpenAI o3-mini (high)

评测结果

OpenAI o3-mini (high) 当前已收录的代表性评测结果包括 HumanEval(1 / 140,得分 97.60)、MATH(1 / 42,得分 97.90)、MATH-500(10 / 46,得分 97.90)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式

综合知识考试

共 1 项评测
评测名称 / 模式
得分
排名/总数
MMLU
常规模式
86.90
27 / 124

程序生成与编辑

共 1 项评测
评测名称 / 模式
得分
排名/总数
HumanEval
常规模式
97.60
1 / 140

数学

共 5 项评测
评测名称 / 模式
得分
排名/总数
MATH
常规模式
97.90
1 / 42
MATH-500
常规模式
97.90
10 / 46
AIME 2024
常规模式
87
18 / 61
11
23 / 60
4.20
40 / 80

抽象归纳与泛化

共 1 项评测
评测名称 / 模式
得分
排名/总数
ARC-AGI-1
常规模式
34.50
147 / 176

科学知识与推理

共 1 项评测
评测名称 / 模式
得分
排名/总数
GPQA Diamond
常规模式
79.70
134 / 253

事实可靠性与幻觉

共 1 项评测
评测名称 / 模式
得分
排名/总数
SimpleQA
常规模式
13.80
37 / 46

仓库修复与多文件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SWE-bench Verified
常规模式
49.30
97 / 116

算法与竞赛编程

共 1 项评测
评测名称 / 模式
得分
排名/总数
LiveCodeBench
常规模式
69.50
58 / 125
OpenAI o3-mini (high)

发布机构

OpenAI o3-mini (high)

模型解读

OpenAI o3 mini是OpenAI发布的第二代推理大模型中最小规模的版本。第一代推理大模型是o1,跳过了o2版本号的原因可能是o2与英国电信运营商的品牌冲突。 o3 mini总共分为三个版本,o3-mini low,o3-mini medium 和o3-mini high。本模型为其中最强的版本,即o3-mini high。ChatGPT中免费用户使用的是o3-mini meidum版本。Plus用户可以选择这个版本。同时,根据测试,这个版本的模型也比之前的o1更强。 不同版本的评测结果如下: | Category | 01-mini | 03-mini (low) | 03-mini (medium) | 03-mini (high) | | --- | --- | --- | --- | --- | | General | 85.2 | 84.9 | 85.9 | 86.9 | | Math | 90.0 | 95.8 | 97.3 | 97.9 | | Factuality | 89.9 | 55.1 | 90.8 | 92.0 | | Eval | 76.0 | 13.0 | 13.4 | 13.8 |

ModelReasoning LevelAverageLCB GenerationCode Completion
o3-minilow0.6180.7560.48
o3-minimedium0.7230.8460.60
o3-minihigh0.8460.8200.833
o1-minihigh0.6740.6280.72

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码