DataLearner 标志
SE

Seed2.1 Pro

推理大模型编程大模型

ByteDance Seed2.1 Pro

发布时间: 2026-06-23更新于: 2026-08-22浏览量: 978
在线体验GitHubHugging Face对比
模型参数
暂无数据
上下文长度
暂无数据
多语言支持
支持
推理能力
4/5

Seed 2.1 Pro(豆包大模型 2.1 Pro,API 名 Doubao-Seed-2.1-Pro)是字节跳动 Seed 团队于 2026 年 6 月 23 日在夏季火山引擎 FORCE 原动力大会上发布的深度思考模型,同场还发布了轻量版 Seed 2.1 Turbo。这次发布几乎不谈参数规模,重点放在 Coding、Agent、VLM 三个方向的实际完成度上:发布会演示中,它在一项芯片设计任务上连续运行近 18 小时、经过 9 轮迭代,完成了含仿真与测试的完整工程流程。官方称其在 Terminal Bench 2.1、SWE-Pro、SciCode 等代码评测中进入第一梯队,在 OSWorld 与 MobileWorld 智能体基准上位列全球前列,多项评测优于 Claude Opus 4.6;Seed 官方页另给出 KINA 48.3、BeyondAIMER 87.0、Workspace Bench 53.0、NL2Repo-Bench 47.0、VideoMME 89.2。支持文本、图像和视频输入,可处理长达一小时的视频。火山方舟标准费率为每百万 tokens 输入 6 元、输出 30 元、缓存命中 1.2 元,官方称综合使用成本较 Claude Opus 4.6 降低近 80%。

数据优先来自官方发布(GitHub、Hugging Face、论文),其次为评测基准官方结果,最后为第三方评测机构数据。 了解数据收集方法

Seed2.1 Pro

模型基本信息

推理过程
支持
思考模式
思考模式 (默认)
上下文长度
暂无数据
最大输出长度
暂无数据
模型类型
推理大模型
输入/输出模态
文本、图像、视频 → 文本
发布时间
2026-06-23
模型文件大小
暂无数据
MoE架构
总参数 / 激活参数
暂无数据 / 不适用
知识截止
暂无数据
Seed2.1 Pro

开源和体验地址

代码开源状态
不开源
预训练权重开源
不开源
GitHub 源码
暂无
Hugging Face
暂无
Seed2.1 Pro

官方介绍与博客

官方论文
DataLearnerAI博客
暂无
Seed2.1 Pro

API接口信息

接口速度
3/5
💡默认单位:$/100万 tokens。若计费单位不同,则以供应商公开的原始标注为准。
标准模式
类型适用条件输入输出
文本-¥6.00/ 1M¥30.00/ 1M
缓存定价Prompt缓存
类型有效期写入读取
文本-¥1.20/ 1M

表中「—」表示该模态在此方向不计费,或供应商未公开对应价格。

Seed2.1 Pro

评测结果

Seed2.1 Pro 当前已收录的代表性评测结果包括 SciCode(2 / 14,得分 59.80)、MMMU-Pro(2 / 7,得分 82.70)、MathVision(4 / 12,得分 94.50)。 本页还汇总了参数规模、上下文长度与 API 价格,便于结合评测结果与部署约束一起判断模型适配度。

思考模式
工具使用

AI Agent - 工具使用

共 1 项评测
评测名称 / 模式
得分
排名/总数
Terminal-Bench 2.1
思考模式工具
71
34 / 47

多模态理解

共 7 项评测
评测名称 / 模式
得分
排名/总数
MathVision
思考模式
92.60
6 / 12
MathVision
思考模式工具
94.50
4 / 12
CharXiv RQ
思考模式
85.40
8 / 18
CharXiv RQ
思考模式工具
86.40
7 / 18
MMMU-Pro
思考模式
81.60
3 / 7
MMMU-Pro
思考模式工具
82.70
2 / 7
BabyVision
思考模式
73.70
3 / 5

编程与软件工程

共 1 项评测
评测名称 / 模式
得分
排名/总数
SciCode
思考模式
59.80
2 / 14
Seed2.1 Pro

发布机构

字节跳动Seed团队
字节跳动Seed团队
查看发布机构详情
ByteDance Seed2.1 Pro

模型解读

不再比参数,改比「能不能干完活」

Seed 2.1 Pro(豆包大模型 2.1 Pro,API 名 Doubao-Seed-2.1-Pro)是字节跳动 Seed 团队于 2026 年 6 月 23 日在北京举办的 2026 夏季火山引擎 FORCE 原动力大会上正式发布的深度思考模型,同场还发布了轻量版 Seed 2.1 Turbo。

这次发布有个明显的取向变化:官方几乎没有强调参数规模,而是把叙事重点放在 Coding、Agent、VLM 三个方向的实际完成度上。字节把它定义为「面向真实生产力」的智能体模型,衡量标准是能不能把一个完整任务跑到底。

一个 18 小时的演示,说明了它想解决什么问题

发布会上最具说服力的不是跑分,而是一个演示:在一项芯片设计任务上,模型连续运行近 18 小时、经过 9 轮迭代,完成了包含仿真与测试在内的完整工程流程。这个场景解释了「深度思考 + 智能体」这套组合真正瞄准的方向——不是回答一个问题,而是在长时间、多轮次、带反馈的工程流程里保持不跑偏。

评测:编程与智能体进第一梯队

官方口径是,Seed 2.1 Pro 在 Terminal Bench 2.1、SWE-Pro、SciCode 等代码评测中进入第一梯队,在 OSWorld 与 MobileWorld 这两个智能体基准上位列全球前列,多项评测优于 Claude Opus 4.6,整体接近 GPT-5.5、Claude Opus 4.7 与 Gemini 3.1 Pro 的水平。

Seed 官方页面另外给出了一组分项成绩:知识类 KINA 48.3、推理类 BeyondAIMER 87.0、智能体 Workspace Bench 53.0、代码 NL2Repo-Bench 47.0、视频理解 VideoMME 89.2

本站结构化评测区只收录能与评测目录精确对应的项目,包括 TerminalBench 2.1、MathVision、MMMU-Pro、BabyVision 和 CharXiv RQ;官方公布但无法精确对齐口径的成绩不做近似换算,以免与其它模型横向比较时产生误导。

多模态与长视频理解

模型支持文本、图像和视频输入,输出文本。VLM 是这一代重点补强的方向之一:官方强调其视觉理解、空间推理与长上下文处理的结合能力,可以处理长达一小时的视频,也能读懂户型图、设计稿这类结构性视觉材料,并在此基础上做项目规划、文件处理和工具调用。

价格:官方主打的就是成本

火山方舟公布的标准费率为每百万 tokens 输入 6 元、输出 30 元,缓存命中 1.2 元(人民币)。官方称其综合使用成本较 Claude Opus 4.6 降低近 80%;轻量版 Seed 2.1 Turbo 的价格约为 Pro 的一半。

一个能说明其使用规模的背景数据:截至 2026 年 6 月,豆包大模型日均 Token 调用量已突破 180 万亿,一年增长超过 10 倍;IDC 数据显示火山引擎在中国公有云 MaaS 市场以 49.5% 的份额位居第一。对国内团队而言,这意味着它是一个供给稳定、成本可预期的选项。

官方来源

Seed2.1 Pro

常见问题

Seed2.1 Pro 是什么模型?

Seed 2.1 Pro(豆包大模型 2.1 Pro)是字节跳动于 2026 年 6 月 23 日火山引擎 FORCE 原动力大会正式发布的深度思考大模型,主打 Coding、Agent、VLM 三大能力,在 Terminal Bench 2.1、SWE-Pro、SciCode 等代码评测中进入第一梯队;官方称综合使用成本较 Claude Opus 4.6 降低近 80%,每百万 tokens 输入 6 元、输出 30 元、缓存命中 1.2 元。

Seed2.1 Pro 支持哪些输入和输出模态?

当前官方资料记录其支持文本、图像、视频输入,并生成文本输出。

Seed2.1 Pro 适合哪些任务?

根据已收录的官方能力标签,它适合推理大模型、多语言、编程大模型相关任务;实际效果应结合具体工作流验证。

Seed2.1 Pro 是否提供 API,价格如何查看?

页面已收录 字节跳动Seed团队 的 3 条定价规则。价格可能随地域、上下文档位、缓存和时间变化,应以页面价格表及官方计费页为准。

Seed2.1 Pro 是否开源?

代码与模型权重按 不开源 记录;使用前仍应核对官方许可原文。

DataLearner 官方微信

欢迎关注 DataLearner 官方微信,获得最新 AI 技术推送

DataLearner 官方微信二维码