DataLearner 标志

Claude Opus 5vsKimi K3

在 14 个共同 benchmark 中,Claude Opus 5 整体领先:Claude Opus 5 领先 12 项,Kimi K3 领先 2 项,持平 0 项,平均分差 +27.43。

Anthropic
Claude Opus 5

Anthropic · 2026-07-24 · 推理大模型

Moonshot AI
Kimi K3

Moonshot AI · 2026-07-16 · 推理大模型

Claude Opus 512 (86%)(14%)2 Kimi K3

评测分数

按能力类目分组,每组内按分差大小排列;共 14 项。

Productivity Knowledge

Claude Opus 5 领先 2/3
评测项Claude Opus 5Kimi K3分差
GDPval-AA v21,8611 / 26Max (With Tools)1,6869 / 26Max (With Tools)+175
AA-AnalystAgent53.752 / 12Max (With Tools + Internet)38.757 / 12Max (With Tools + Internet)+15
AutomationBench2612 / 15Max (With Tools)30.809 / 15Max (With Tools)-4.80

AI Agent - Tool Usage

Claude Opus 5 领先 2/2
评测项Claude Opus 5Kimi K3分差
Terminal-Bench-Science 0.1303 / 11Max (With Tools)7.109 / 11Max (With Tools)+22.90
OSWorld 2.070.573 / 10Max (With Tools)58.308 / 10Max (With Tools)+12.27

Coding and Software Engineer

Claude Opus 5 领先 2/2
评测项Claude Opus 5Kimi K3分差
Text Arena (Coding)1,7121 / 35Max (No Tools)1,6822 / 35Max (No Tools)+30.13
DeepSWE68.808 / 35Max (With Tools)67.509 / 35Max (With Tools)+1.30

Math and Reasoning

Claude Opus 5 领先 2/2
评测项Claude Opus 5Kimi K3分差
FrontierMath Tier 4 v273.176 / 42Max (No Tools)39.0215 / 42Max (No Tools)+34.15
FrontierMath v285.615 / 58Max (No Tools)72.1813 / 58Max (No Tools)+13.43

AI Agent - Information Search

Kimi K3 领先 1/1
评测项Claude Opus 5Kimi K3分差
BrowseComp90.803 / 57Max (With Tools + Internet)91.202 / 57Max (With Tools + Internet)-0.40

General Knowledge

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
HLE64.702 / 191Max (With Tools)5617 / 191Max (With Tools)+8.70

Text Embedding

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
Context Arena97.721 / 126Max (No Tools)71.7559 / 126Max (No Tools)+25.97

Writing and Creative Capabilities

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
Creative Writing2,1213 / 106Normal (No Tools)2,0714 / 106Normal (No Tools)+50

科学与综合推理

Claude Opus 5 领先 1/1
评测项Claude Opus 5Kimi K3分差
GPQA Diamond93.8813 / 273Max (No Tools)93.5017 / 273Max (No Tools)+0.38

规格对比

字段Claude Opus 5Kimi K3
发布机构AnthropicMoonshot AI
发布时间2026-07-242026-07-16
模型类型推理大模型推理大模型
架构稠密模型MoE 架构
参数规模暂无数据2.8万亿
上下文长度1M1M
最大输出128K1M

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Opus 5Kimi K3
文本输入$5 / 1M tokens¥20 / 1M tokens
文本输出$25 / 1M tokens¥100 / 1M tokens
缓存读取$0.5 / 1M tokens¥2 / 1M tokens
缓存写入$6.25 / 1M tokens暂无公开价格

小结

  • Claude Opus 5在以下类目领先:Productivity Knowledge (2/3)、AI Agent - Tool Usage (2/2)、Coding and Software Engineer (2/2)、Math and Reasoning (2/2)、General Knowledge (1/1)、Text Embedding (1/1)、Writing and Creative Capabilities (1/1)、科学与综合推理 (1/1)
  • Kimi K3在以下类目领先:AI Agent - Information Search (1/1)

14 个共同 benchmark 上,Claude Opus 5 平均高出 27.43 分。

单项差距最大的 benchmark:GDPval-AA v2 — Claude Opus 5 1,861,Kimi K3 1,686(分差 +175)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。