DataLearner 标志

Claude Opus 5vsKimi K3

在 6 个共同 benchmark 中,Claude Opus 5 整体领先:Claude Opus 5 领先 4 项,Kimi K3 领先 2 项,持平 0 项,平均分差 +61.63。

Anthropic
Claude Opus 5

Anthropic · 2026-07-24 · 推理大模型

Moonshot AI
Kimi K3

Moonshot AI · 2026-07-16 · 推理大模型

Claude Opus 54 (67%)(33%)2 Kimi K3

评测分数

按能力类目分组,每组内按分差大小排列;共 6 项。

Productivity Knowledge

Claude Opus 5 领先 2/2
评测项Claude Opus 5Kimi K3分差
GDPval-AA v21,8611 / 5Max (With Tools)1,6682 / 5Max (With Tools)+193
AA-Briefcase1,7201 / 2Max (With Tools)1,5482 / 2Max (With Tools)+172

AI Agent - Information Search

Kimi K3 领先 1/1
评测项Claude Opus 5Kimi K3分差
BrowseComp90.802 / 53Max (With Tools + Internet)91.201 / 53Max (With Tools + Internet)-0.40

AI Agent - Tool Usage

Kimi K3 领先 1/1
评测项Claude Opus 5Kimi K3分差
Automation Bench262 / 2Max (With Tools)30.801 / 2Max (With Tools)-4.80

Coding and Software Engineer

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
DeepSWE68.804 / 19Max (With Tools)67.505 / 19Max (With Tools)+1.30

General Knowledge

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
HLE64.701 / 172Max (With Tools)5612 / 172Max (With Tools)+8.70

规格对比

字段Claude Opus 5Kimi K3
发布机构AnthropicMoonshot AI
发布时间2026-07-242026-07-16
模型类型推理大模型推理大模型
架构稠密模型MoE 架构
参数规模暂无数据2.8万亿
上下文长度1M1M
最大输出128K1M

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Opus 5Kimi K3
文本输入$5 / 1M tokens¥20 / 1M tokens
文本输出$25 / 1M tokens¥100 / 1M tokens
缓存读取$0.5 / 1M tokens¥2 / 1M tokens
缓存写入$6.25 / 1M tokens暂无公开价格

小结

  • Claude Opus 5在以下类目领先:Productivity Knowledge (2/2)、Coding and Software Engineer (1/1)、General Knowledge (1/1)
  • Kimi K3在以下类目领先:AI Agent - Information Search (1/1)、AI Agent - Tool Usage (1/1)

6 个共同 benchmark 上,Claude Opus 5 平均高出 61.63 分。

单项差距最大的 benchmark:GDPval-AA v2 — Claude Opus 5 1,861,Kimi K3 1,668(分差 +193)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。