DataLearner 标志

Qwen3.8-Flash-NextvsQwen3.8-27B

在 1 个同模式 benchmark 中,Qwen3.8-Flash-Next 整体领先:Qwen3.8-Flash-Next 领先 1 项,Qwen3.8-27B 领先 0 项,持平 0 项,平均分差 +0.92。另有 14 项测试模式不同,仅供参考。

阿里巴巴
Qwen3.8-Flash-Next

阿里巴巴 · 2026-08-26 · 推理大模型

阿里巴巴
Qwen3.8-27B

阿里巴巴 · 2026-08-14 · 推理大模型

Qwen3.8-Flash-Next1 项(100%)(0%)0 项Qwen3.8-27B

评测分数

按能力类目分组,每组内按分差大小排列;共 1 项。

跨能力综合测试

Qwen3.8-Flash-Next 领先 1/1
评测项Qwen3.8-Flash-NextQwen3.8-27B分差
LiveBench76.1933 / 157Reported best (effort unspecified)75.2743 / 157Reported best (effort unspecified)+0.92

测试模式不同的成绩

共 14 项。两款模型的公开成绩来自不同测试模式,分数不直接可比,不计入胜负和平均分差。

评测项Qwen3.8-Flash-NextQwen3.8-27B
Terminal-Bench 4.025.30Thinking (With Tools)5.60Extra-High (With Tools)
LiveCodeBench91.90Extra-High (No Tools)90.30Thinking (No Tools)
CharXiv RQ90.60Extra-High (With Tools)90.20Thinking (With Tools)
GDP.pdf15.60Thinking (No Tools)16.40Extra-High (No Tools)
HLE35.90Extra-High (No Tools)30.80Thinking (No Tools)
DeepSWE58.70Extra-High (With Tools)42.20Thinking (With Tools)
NL2Repo-Bench48.10Extra-High (With Tools)42.30Thinking (With Tools)
SWE-Bench Pro - Public62.50Extra-High (With Tools)61.70Thinking (With Tools)
SciCode50.60Thinking (No Tools)36.20Normal (No Tools)
CritPt11.10Thinking (No Tools)0.30Normal (No Tools)
GPQA Diamond91.70Extra-High (No Tools)89.20Thinking (No Tools)
τ³-Banking45.40Thinking (With Tools)20Normal (With Tools)
MathVision95.70Extra-High (With Tools)94.60Thinking (With Tools)
MMMU-Pro79.80Thinking (No Tools)69.90Normal (No Tools)

规格对比

字段Qwen3.8-Flash-NextQwen3.8-27B
发布机构阿里巴巴阿里巴巴
发布时间2026-08-262026-08-14
模型类型推理大模型推理大模型
架构MoE 架构稠密模型
参数规模1250亿270亿
上下文长度256K(原生,可扩展至 1M)256K
最大输出128K128K

API 调用价格

价格优先使用 DataLearner 配置的 API 记录;缺失项不做推测。

价格项Qwen3.8-Flash-NextQwen3.8-27B
文本输入¥1 / 1M tokens$0.5 / 1M tokens
文本输出¥3 / 1M tokens$3 / 1M tokens
缓存读取暂无公开价格$0.1 / 1M tokens

小结

  • Qwen3.8-Flash-Next在以下类目领先:跨能力综合测试 (1/1)

1 个同模式 benchmark 上,Qwen3.8-Flash-Next 平均高出 0.92 分。

单项差距最大的 benchmark:LiveBench — Qwen3.8-Flash-Next 76.19,Qwen3.8-27B 75.27(分差 +0.92)。

本页正文由结构化模型、价格与 benchmark 数据生成,不使用实时 LLM 撰写。