DataLearner 标志

Claude Sonnet 5.5vsClaude Sonnet 4.6

在 3 个共同 benchmark 中,Claude Sonnet 5.5 整体领先:Claude Sonnet 5.5 领先 3 项,Claude Sonnet 4.6 领先 0 项,持平 0 项,平均分差 +46.15。

Anthropic
Claude Sonnet 5.5

Anthropic · 2026-09-28 · 推理大模型

Anthropic
Claude Sonnet 4.6

Anthropic · 2026-02-17 · 聊天大模型

Claude Sonnet 5.53 项(100%)(0%)0 项Claude Sonnet 4.6

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

程序生成与编辑

Claude Sonnet 5.5 领先 1/1
评测项Claude Sonnet 5.5Claude Sonnet 4.6分差
Vibe Code Bench v1.192.391 / 64Max (With Tools)51.4839 / 64Max (With Tools)+40.91

维护、优化与工程管理

Claude Sonnet 5.5 领先 1/1
评测项Claude Sonnet 5.5Claude Sonnet 4.6分差
Code Migration69.831 / 47Max (With Tools)39.8924 / 47Max (With Tools)+29.94

自主开发与终端任务

Claude Sonnet 5.5 领先 1/1
评测项Claude Sonnet 5.5Claude Sonnet 4.6分差
Terminal-Bench 4.070.601 / 98Max (With Tools)372 / 98Max (With Tools)+67.60

规格对比

字段Claude Sonnet 5.5Claude Sonnet 4.6
发布机构AnthropicAnthropic
发布时间2026-09-282026-02-17
模型类型推理大模型聊天大模型
架构稠密模型稠密模型
参数规模暂无数据暂无数据
上下文长度1M1M
最大输出128K8K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Sonnet 5.5Claude Sonnet 4.6
文本输入$2 / 1M tokens$3 / 1M tokens
文本输出$10 / 1M tokens$15 / 1M tokens
缓存读取$0.2 / 1M tokens$0.3 / 1M tokens
缓存写入$2.5 / 1M tokens$3.75 / 1M tokens

小结

  • Claude Sonnet 5.5在以下类目领先:程序生成与编辑 (1/1)、维护、优化与工程管理 (1/1)、自主开发与终端任务 (1/1)

3 个共同 benchmark 上,Claude Sonnet 5.5 平均高出 46.15 分。

单项差距最大的 benchmark:Terminal-Bench 4.0 — Claude Sonnet 5.5 70.60,Claude Sonnet 4.6 3(分差 +67.60)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。