DataLearner 标志
GP

GPT OSS 20B

推理大模型GPT OSSGPT OSS 20B

GPT Opensources 20B

发布时间: 2025-08-06更新于: 2026-06-15浏览量: 1,679
在线体验GitHubHugging Face对比
模型参数
210亿
上下文长度
128K
多语言支持
支持
推理能力
3/5

GPT Opensources 20B 是由 OpenAI 发布的 AI 模型,发布时间为 2025-08-06,定位为 推理大模型,参数规模约为 210亿,上下文长度为 128K,模型文件大小约 42GB,采用 Apache 2.0 许可,在 CodeForces 上取得 2516.00 分。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

GPT OSS 20B

模型基本信息

推理过程
支持
思考模式
常规模式 (默认)思考模式
上下文长度
128K tokens
最大输出长度
4K tokens
模型类型
推理大模型
输入/输出模态
文本 → 文本
发布时间
2025-08-06
模型文件大小
42GB
MoE架构
总参数 / 激活参数
210亿 / 36亿
知识截止
暂无数据
GPT OSS 20B

开源和体验地址

代码开源状态
预训练权重开源
Apache 2.0- 免费商用授权
GitHub 源码
暂无
在线体验
暂无
GPT OSS 20B

官方介绍与博客

DataLearnerAI博客
暂无
GPT OSS 20B

API接口信息

接口速度
2/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-$0.070/ 1M tokens$0.300/ 1M tokens
批量模式
类型适用条件输入输出
文本-$0.035/ 1M tokens$0.150/ 1M tokens
缓存定价Prompt缓存
类型有效期写入读取
文本-$0.070/ 1M tokens$0.040/ 1M tokens
文本-$0.070/ 1M tokens
缓存状态 = write
文本-$0.040/ 1M tokens
缓存状态 = hit

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

GPT OSS 20B

评测结果

GPT OSS 20B 当前已收录的代表性评测结果包括 AIME 2024(3 / 62,得分 96)、AIME2025(15 / 215,得分 98.70)、LiveCodeBench(60 / 250,得分 77.70)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

综合评估

共 8 项评测
评测名称 / 模式
得分
排名/总数
MMLU
思考模式
85.30
41 / 124
73.14
92 / 176
MMLU Pro
思考模式
74
90 / 176
HLE
5.30
471 / 563
HLE
思考模式
10.90
381 / 563
HLE
思考模式工具
17.30
318 / 563
HLE
11
377 / 563
1.40
135 / 200

科学与综合推理

共 4 项评测
评测名称 / 模式
得分
排名/总数
53.16
403 / 462
60.80
373 / 462
GPQA Diamond
思考模式
71.50
306 / 462
45.96
420 / 462

编程与软件工程

共 6 项评测
评测名称 / 模式
得分
排名/总数
CodeForces
思考模式
2230
13 / 21
CodeForces
思考模式工具
2516
10 / 21
65.20
115 / 250
77.70
60 / 250
38.90
109 / 130
SWE-bench Verified
思考模式
34
110 / 116

数学推理

共 6 项评测
评测名称 / 模式
得分
排名/总数
62.30
134 / 215
AIME2025
思考模式
79
99 / 215
AIME2025
思考模式工具
98.70
15 / 215
89.30
56 / 215
AIME2025
工具
89.17
58 / 215
AIME 2024
思考模式工具
96
3 / 62

写作和创作

共 1 项评测
评测名称 / 模式
得分
排名/总数
Creative Writing
常规模式
663.70
104 / 106

Agent能力评测

共 6 项评测
评测名称 / 模式
得分
排名/总数
50.30
170 / 264
60.20
159 / 264
τ²-Bench
思考模式工具
47.70
37 / 44
4.50
214 / 244
10.60
182 / 244
τ³-Banking
工具
7
141 / 164

指令跟随

共 2 项评测
评测名称 / 模式
得分
排名/总数
57.80
126 / 282
65.10
101 / 282

AI Agent - 信息收集

共 1 项评测
评测名称 / 模式
得分
排名/总数
BrowseComp
思考模式工具
28.30
54 / 57

长上下文能力

共 2 项评测
评测名称 / 模式
得分
排名/总数
31
162 / 170
34.70
159 / 170

OpenClaw智能体能力综合测评

共 2 项评测
评测名称 / 模式
得分
排名/总数
Pinch Bench
思考模式工具
66
35 / 38
36.34
42 / 45

AI Agent - 工具使用

共 1 项评测
评测名称 / 模式
得分
排名/总数
13.90
167 / 192

生产力知识

共 1 项评测
评测名称 / 模式
得分
排名/总数
GDPval-AA v2
工具
514
104 / 105

多模态理解

共 1 项评测
评测名称 / 模式
得分
排名/总数
2
106 / 118
GPT OSS 20B

发布机构

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码