DataLearner 标志

Qwen3.6-Max-PreviewvsOpus 4.7

在 6 个共同 benchmark 中,Opus 4.7 整体领先:Qwen3.6-Max-Preview 领先 1 项,Opus 4.7 领先 5 项,持平 0 项,平均分差 -4.67。

阿里巴巴
Qwen3.6-Max-Preview

阿里巴巴 · 2026-04-18 · 聊天大模型

Anthropic
Opus 4.7

Anthropic · 2026-04-16 · 推理大模型

Qwen3.6-Max-Preview1 (17%)(83%)5 Opus 4.7

评测分数

按能力类目分组,每组内按分差大小排列;共 6 项。

Coding and Software Engineer

Opus 4.7 领先 2/2
评测项Qwen3.6-Max-PreviewOpus 4.7分差
SWE-bench Verified78.8021 / 114Thinking (With Tools)87.606 / 114Extended (with tools)-8.80
SWE-Bench Pro - Public57.3020 / 57Deep Thinking (With Tools)64.308 / 57Extended (with tools)-7

AI Agent - Tool Usage

Opus 4.7 领先 1/1
评测项Qwen3.6-Max-PreviewOpus 4.7分差
Terminal Bench 2.065.4011 / 48Deep Thinking (With Tools)69.406 / 48Extended (with tools)-4

General Knowledge

Opus 4.7 领先 1/1
评测项Qwen3.6-Max-PreviewOpus 4.7分差
HLE50.2029 / 181Thinking (With Tools)54.7015 / 181Extended (with tools)-4.50

常识推理

Qwen3.6-Max-Preview 领先 1/1
评测项Qwen3.6-Max-PreviewOpus 4.7分差
SimpleBench6311 / 67Normal (No Tools)62.9012 / 67Normal (No Tools)+0.10

科学与综合推理

Opus 4.7 领先 1/1
评测项Qwen3.6-Max-PreviewOpus 4.7分差
GPQA Diamond90.4036 / 226最高(无工具)94.205 / 226Extended (no tools)-3.80

规格对比

字段Qwen3.6-Max-PreviewOpus 4.7
发布机构阿里巴巴Anthropic
发布时间2026-04-182026-04-16
模型类型聊天大模型推理大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度262K1000K
最大输出64K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Qwen3.6-Max-PreviewOpus 4.7
文本输入$1.3 / 1M tokens$5 / 1M tokens
文本输出$7.8 / 1M tokens$25 / 1M tokens
缓存读取暂无公开价格$0.5 / 1M tokens
缓存写入暂无公开价格$6.25 / 1M tokens

小结

  • Qwen3.6-Max-Preview在以下类目领先:常识推理 (1/1)
  • Opus 4.7在以下类目领先:Coding and Software Engineer (2/2)、AI Agent - Tool Usage (1/1)、General Knowledge (1/1)、科学与综合推理 (1/1)

6 个共同 benchmark 上,Opus 4.7 平均高出 4.67 分。

单项差距最大的 benchmark:SWE-bench Verified — Qwen3.6-Max-Preview 78.80,Opus 4.7 87.60(分差 -8.80)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。