DataLearner 标志

Claude Sonnet 5.5vsDeepSeek-V4.1-Flash

在 3 个共同 benchmark 中,Claude Sonnet 5.5 整体领先:Claude Sonnet 5.5 领先 2 项,DeepSeek-V4.1-Flash 领先 1 项,持平 0 项,平均分差 +11.43。

Anthropic
Claude Sonnet 5.5

Anthropic · 2026-09-28 · 推理大模型

DeepSeek-AI
DeepSeek-V4.1-Flash

DeepSeek-AI · 2026-09-10 · 多模态大模型

Claude Sonnet 5.52 项(67%)(33%)1 项DeepSeek-V4.1-Flash

评测分数

按能力类目分组,每组内按分差大小排列;共 3 项。

办公与文档流程

DeepSeek-V4.1-Flash 领先 1/1
评测项Claude Sonnet 5.5DeepSeek-V4.1-Flash分差
AutomationBench44.7011 / 24Max (With Tools)54.801 / 24Max (With Tools)-10.10

综合知识考试

Claude Sonnet 5.5 领先 1/1
评测项Claude Sonnet 5.5DeepSeek-V4.1-Flash分差
HLE64.504 / 235Max (With Tools)63.905 / 235Max (With Tools)+0.60

自主开发与终端任务

Claude Sonnet 5.5 领先 1/1
评测项Claude Sonnet 5.5DeepSeek-V4.1-Flash分差
Terminal-Bench 4.070.601 / 97Max (With Tools)26.8031 / 97Max (With Tools)+43.80

规格对比

字段Claude Sonnet 5.5DeepSeek-V4.1-Flash
发布机构AnthropicDeepSeek-AI
发布时间2026-09-282026-09-10
模型类型推理大模型多模态大模型
架构稠密模型MoE 架构
参数规模暂无数据5520亿
上下文长度1M1M
最大输出128K384K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Claude Sonnet 5.5DeepSeek-V4.1-Flash
文本输入$2 / 1M tokens¥1 / 1M tokens
文本输出$10 / 1M tokens¥4 / 1M tokens
缓存读取$0.2 / 1M tokens¥0.02 / 1M tokens
缓存写入$2.5 / 1M tokens暂无公开价格

小结

  • Claude Sonnet 5.5在以下类目领先:综合知识考试 (1/1)、自主开发与终端任务 (1/1)
  • DeepSeek-V4.1-Flash在以下类目领先:办公与文档流程 (1/1)

3 个共同 benchmark 上,Claude Sonnet 5.5 平均高出 11.43 分。

单项差距最大的 benchmark:Terminal-Bench 4.0 — Claude Sonnet 5.5 70.60,DeepSeek-V4.1-Flash 26.80(分差 +43.80)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。