DataLearner 标志

Arcada Labs Code Categories Arena 代码能力排行榜

基于 Arcada Labs Code Categories Arena 用户匿名投票的最新AI大模型代码能力排行榜,通过 Bradley-Terry 模型对 Website、UI Component、Game Dev、Data Visualization 等代码子类别进行综合评分与排名。

榜首模型

GLM 5.2

最高得分

1352.00

模型数量

136

数据版本

2026年07月12日

数据来源: Arcada Labs

榜单历史快照月份:

排名总表

排名模型名称得分95% CI投票数机构许可证
GLM 5.2Zhipu AI1352.00+/-7.98,533Zhipu AIOpen Source
OpenAIGPT-5.6 SolOpenAI1350.00+/-16.81,792OpenAIProprietary
AnthropicClaude Fable 5Anthropic1344.00+/-11.63,881AnthropicProprietary
4AnthropicClaude Opus 4.6Anthropic1336.00+/-5.123,055AnthropicProprietary
5AnthropicClaude Opus 4.6 (thinking)Anthropic1330.00+/-5.519,041AnthropicProprietary
6AnthropicOpus 4.7Anthropic1330.00+/-5.816,847AnthropicProprietary
7xAIGrok 4.5xAI1328.00+/-11.93,493xAIProprietary
8GLM 5.1智谱AI1321.00+/-6.612,099智谱AIOpen Source
9Moonshot AIKimi K2.6Moonshot AI1320.00+/-4.923,919Moonshot AIOpen Source
10AnthropicClaude Sonnet 4.6Anthropic1319.00+/-5.122,045AnthropicProprietary
11GLM-5-Turbo智谱AI1312.00+/-4.727,317智谱AIProprietary
12MiMo-V2.5-ProXiaomi1312.00+/-7.210,020XiaomiOpen Source
13Qwen3.7 Max阿里巴巴1306.00+/-5.816,473阿里巴巴Proprietary
14Moonshot AIKimi K2.7 CodeMoonshot AI1300.00+/-8.27,614Moonshot AIOpen Source
15Google Deep MindGemini 3.5 FlashGoogle Deep Mind1297.00+/-5.816,254Google Deep MindProprietary
16MiniMaxMiniMax M3MiniMax1297.00+/-6.512,553MiniMaxOpen Source
17MiMo-V2.5Xiaomi1295.00+/-4.431,718XiaomiOpen Source
18Muse SparkFacebook AI研究实验室1294.00+/-10.94,249Facebook AI研究实验室Proprietary
19OpenAIGPT-5.5OpenAI1291.00+/-5.915,610OpenAIProprietary
20GLM-5智谱AI1288.00+/-3.846,436智谱AIOpen Source
21AnthropicOpus 4.5Anthropic1284.00+/-4.135,670AnthropicProprietary
22Google Deep MindGemini 3.1 Pro PreviewGoogle Deep Mind1283.00+/-523,843Google Deep MindProprietary
23DeepSeek-AIDeepSeek-V4-ProDeepSeek-AI1281.00+/-5.517,824DeepSeek-AIOpen Source
24Moonshot AIKimi K2.5 (thinking)Moonshot AI1279.00+/-439,455Moonshot AIOpen Source
25AnthropicClaude Opus 4.8Anthropic1276.00+/-5.915,114AnthropicProprietary
26MiniMaxAIMiniMax-M2.7MiniMaxAI1275.00+/-4.431,074MiniMaxAIOpen Source
27Google Deep MindGemini 3.1 Pro PreviewGoogle Deep Mind1271.00+/-4.235,060Google Deep MindProprietary
28GLM-5V-Turbo智谱AI1270.00+/-4.331,672智谱AIProprietary
29Nex N2 ProNex AGI1265.00+/-9.15,932Nex AGIOpen Source
30Qwen 3.6 Plus Preview阿里巴巴1265.00+/-4.726,080阿里巴巴Proprietary
31xAIGrok 4.20 Beta (Reasoning)xAI1260.00+/-4.726,100xAIProprietary
32GLM-4.7智谱AI1258.00+/-3.747,633智谱AIOpen Source
33OpenAIGPT-5.4 (Design Skill, Medium)OpenAI1254.00+/-7.29,880OpenAIProprietary
34OpenAIGPT-5.4 (medium)OpenAI1252.00+/-5.319,407OpenAIProprietary
35MiniMaxAIMiniMax M2.5MiniMaxAI1249.00+/-6.711,504MiniMaxAIOpen Source
36DeepSeek-AIDeepSeek-V4-FlashDeepSeek-AI1248.00+/-4.725,437DeepSeek-AIOpen Source
37xAIGrok 4.20 BetaxAI1241.00+/-4.627,379xAIProprietary
38xAIGrok 4.3 BetaxAI1234.00+/-5.121,060xAIProprietary
39MiniMaxAIM2.1MiniMaxAI1232.00+/-5.120,805MiniMaxAIOpen Source
40Google Deep MindGemini 3.0 FlashGoogle Deep Mind1231.00+/-10.64,414Google Deep MindProprietary
41AnthropicClaude Sonnet 4.5Anthropic1225.00+/-3.840,900AnthropicProprietary
42AnthropicClaude Sonnet 4.5 (thinking)Anthropic1224.00+/-3.940,107AnthropicProprietary
43OpenAIGPT-5.4 (low)OpenAI1222.00+/-521,683OpenAIProprietary
44Qwen3.5-397B-A17B阿里巴巴1222.00+/-7.98,131阿里巴巴Open Source
45GLM-4.7-Flash智谱AI1220.00+/-6.611,706智谱AIOpen Source
46OpenAIGPT-5.4 (None)OpenAI1220.00+/-4.824,150OpenAIProprietary
47AnthropicClaude Sonnet 3.7Anthropic1219.00+/-5.915,245AnthropicProprietary
48DeepSeek-AIDeepSeek-V3.1 (thinking)DeepSeek-AI1217.00+/-5.716,258DeepSeek-AIOpen Source
49AnthropicOpus 4.1 (thinking)Anthropic1213.00+/-5.815,677AnthropicProprietary
50DeepSeek-AIDeepSeek V3.2-ExpDeepSeek-AI1213.00+/-5.319,490DeepSeek-AIOpen Source
51OpenAIGPT-5.1 (high)OpenAI1213.00+/-5.716,057OpenAIProprietary
52OpenAIGPT-5.2 (medium)OpenAI1212.00+/-4.528,372OpenAIProprietary
53OpenAIGPT-5 (high)OpenAI1211.00+/-6.213,397OpenAIProprietary
54OpenAIGPT-5.2 (None)OpenAI1211.00+/-4.429,322OpenAIProprietary
55StepFunStep 3.7 FlashStepFun1210.00+/-6.313,365StepFunOpen Source
56Qwen3.5 Plus (0215)阿里巴巴1209.00+/-5.319,028阿里巴巴Proprietary
57GLM-4.6智谱AI1208.00+/-5.616,911智谱AIOpen Source
58OpenAIGPT-5.2 (low)OpenAI1208.00+/-4.625,763OpenAIProprietary
59AnthropicOpus 4.1Anthropic1207.00+/-3.940,219AnthropicProprietary
60GLM-4.5智谱AI1207.00+/-5.219,637智谱AIOpen Source
61OpenAIGPT-5 (minimal)OpenAI1207.00+/-4.233,251OpenAIProprietary
62DeepSeek-AIDeepSeek V3.2DeepSeek-AI1206.00+/-4.429,394DeepSeek-AIOpen Source
63OpenAIGPT-5.1 (medium)OpenAI1204.00+/-521,292OpenAIProprietary
64AnthropicClaude Opus 4Anthropic1203.00+/-5.616,669AnthropicProprietary
65TencentHy3Tencent1199.00+/-20.51,202TencentOpen Source
66OpenAIGPT-5.1 (low)OpenAI1198.00+/-522,160OpenAIProprietary
67MiMo-V2-FlashXiaomi1198.00+/-4.135,857XiaomiOpen Source
68Google Deep MindGemini 2.5-ProGoogle Deep Mind1196.00+/-8.67,044Google Deep MindProprietary
69OpenAIGPT-5.1 CodexOpenAI1193.00+/-16.41,807OpenAIProprietary
70OpenAIGPT-5.1 (None)OpenAI1193.00+/-4.922,273OpenAIProprietary
71OpenAIGPT-5.2 (high)OpenAI1192.00+/-10.84,167OpenAIProprietary
72OpenAIGPT-5.3 CodexOpenAI1187.00+/-5.815,761OpenAIProprietary
73Qwen3-Coder-480B-A35B阿里巴巴1185.00+/-16.31,958阿里巴巴Open Source
74MistralAIMistral Large 3MistralAI1184.00+/-4.330,837MistralAIOpen Source
75AnthropicClaude Sonnet 4Anthropic1183.00+/-5.517,532AnthropicProprietary
76DeepSeek-AIDeepSeek-R1-0528DeepSeek-AI1181.00+/-5.417,944DeepSeek-AIOpen Source
77GLM-4.5-Air智谱AI1180.00+/-5.517,256智谱AIOpen Source
78AnthropicClaude Sonnet 4 (thinking)Anthropic1179.00+/-5.716,227AnthropicProprietary
79MiniMaxAIMiniMax M2MiniMaxAI1177.00+/-6.910,828MiniMaxAIOpen Source
80AesCoder-4BDesignFlow1167.00+/-3.940,177DesignFlowOpen Source
81MistralAIMistral Medium 3.5MistralAI1164.00+/-6.811,490MistralAIOpen Source
82NVIDIANemotron 3 UltraNVIDIA1164.00+/-7.69,540NVIDIAOpen Source
83MistralMistral Medium 3.1 (2508)Mistral1163.00+/-4.528,014MistralProprietary
84Trinity Large ThinkingArcee AI1158.00+/-6.413,416Arcee AIOpen Source
85AnthropicHaiku 4.5Anthropic1156.00+/-4.136,008AnthropicProprietary
86OpenAIGPT-5-miniOpenAI1156.00+/-437,565OpenAIProprietary
87DeepSeek-AIDeepSeek-V3.1DeepSeek-AI1154.00+/-5.120,278DeepSeek-AIOpen Source
88Qwen3-Max-Thinking阿里巴巴1152.00+/-4.233,808阿里巴巴Proprietary
89DeepSeek-AIDeepSeek-V3-0324DeepSeek-AI1151.00+/-5.319,257DeepSeek-AIOpen Source
90Prime Intellect: INTELLECT-3Prime Intellect1149.00+/-4.331,884Prime IntellectOpen Source
91Google Deep MindGemini 2.5 Flash-Preview-09-2025Google Deep Mind1146.00+/-5.319,299Google Deep MindProprietary
92xAIGrok 4 FastxAI1143.00+/-437,255xAIProprietary
93Moonshot AIKimi K2 0905Moonshot AI1140.00+/-17.91,504Moonshot AIOpen Source
94OpenAIGPT-5.1 Codex MiniOpenAI1136.00+/-4.234,250OpenAIProprietary
95xAIGrok 4.1 FastxAI1135.00+/-4.233,898xAIProprietary
96xAIGrok 4.1 Fast (reasoning)xAI1130.00+/-4.331,599xAIProprietary
97OpenAIGPT-5-NanoOpenAI1127.00+/-8.66,710OpenAIProprietary
98Moonshot AIKimi K2 Turbo PreviewMoonshot AI1126.00+/-15.22,094Moonshot AIOpen Source
99Google Deep MindGemini 2.5 Flash-Lite-Preview-09-2025Google Deep Mind1123.00+/-8.56,860Google Deep MindProprietary
100GoogleGemini 3.1 Flash-Lite PreviewGoogle1114.00+/-524,146GoogleProprietary
101Microsoft AzurePhi-3-medium 14B-previewMicrosoft Azure1111.00+/-8.96,396Microsoft AzureProprietary
102MistralAIMinistral 3 14BMistralAI1107.00+/-14.42,379MistralAIOpen Source
103Google Deep MindGemini 2.5 FlashGoogle Deep Mind1101.00+/-8.56,960Google Deep MindProprietary
104v0-1.5-mdVercel1099.00+/-6.911,081VercelProprietary
105xAIGrok 3xAI1095.00+/-4.626,862xAIProprietary
106MistralAIMinistral 3 8BMistralAI1095.00+/-14.32,427MistralAIOpen Source
107xAIGrok 4 Fast (reasoning)xAI1093.00+/-4.137,909xAIProprietary
108Qwen3-235B-A22B-2507阿里巴巴1081.00+/-8.66,932阿里巴巴Open Source
109Moonshot AIKimi K2Moonshot AI1076.00+/-19.41,352Moonshot AIOpen Source
110MistralMagistral Medium 1.2 (2509)Mistral1076.00+/-9.45,851MistralProprietary
111AlibabaQwen3-235B-A22B-Thinking-2507Alibaba1075.00+/-9.16,169AlibabaOpen Source
112OpenAIGPT-4.1OpenAI1068.00+/-17.31,747OpenAIProprietary
113OpenAIOpenAI o3OpenAI1062.00+/-19.51,365OpenAIProprietary
114xAIGrok 4xAI1058.00+/-523,998xAIProprietary
115MistralAIDevstral MediumMistralAI1055.00+/-8.67,158MistralAIProprietary
116MistralMinistral 3 3B (2512)Mistral1052.00+/-13.52,852MistralOpen Source
117MistralCodestral 2508Mistral1049.00+/-8.86,745MistralProprietary
118Qwen3-235B-A22B阿里巴巴1044.00+/-10.15,154阿里巴巴Open Source
119xAIGrok Code Fast 1xAI1041.00+/-11.14,295xAIProprietary
120OpenAIGPT-4.1 miniOpenAI1036.00+/-18.31,566OpenAIProprietary
121Mercury 2Inception1033.00+/-10.36,814InceptionProprietary
122MistralMagistral Small 1.2 (2509)Mistral1028.00+/-9.26,448MistralOpen Source
123OpenAIOpenAI o4 - miniOpenAI1018.00+/-16.22,011OpenAIProprietary
124Olmo 3.1 32B ThinkAllen AI1017.00+/-6.316,162Allen AIOpen Source
125OpenAIGPT-4.1 nanoOpenAI1005.00+/-16.91,901OpenAIProprietary
126OpenAIGPT OSS 120BOpenAI1005.00+/-10.35,268OpenAIOpen Source
127Qwen3-30B-A3B阿里巴巴984.00+/-14.62,575阿里巴巴Open Source
128xAIGrok 3 minixAI973.00+/-8.87,626xAIProprietary
129NVIDIALlama 3.1 Nemotron Ultra 253BNVIDIA971.00+/-13.83,172NVIDIAOpen Source
130MistralAIMistral-Small-3.2MistralAI949.00+/-20.81,243MistralAIOpen Source
131Llama 4 MaverickFacebook AI研究实验室922.00+/-18.41,678Facebook AI研究实验室Open Source
132MistralMistral Large 2.1 (2411)Mistral905.00+/-211,317MistralProprietary
133OpenAIGPT-4oOpenAI903.00+/-18.11,780OpenAIProprietary
134MistralCodestral 2 (2501)Mistral876.00+/-20.71,444MistralOpen Source
135MistralAIDevstral Small 1.1MistralAI849.00+/-22.51,250MistralAIOpen Source
136Llama 4 ScoutFacebook AI研究实验室832.00+/-22.61,275Facebook AI研究实验室Open Source

数据仅供参考,以官方来源为准。模型名称旁的链接可跳转到 DataLearner 模型详情页。

关于本榜单

本榜单数据来源于Design Arena,由 Y Combinator 支持的 Arcada Labs 开发,是专注于评测 AI 设计代码生成能力的众包匿名对战平台。

与 LMArena 评测通用文本和编程能力不同,Design Arena 的代码榜专门考察模型生成具有视觉呈现效果的前端代码的能力。平台将代码任务细分为 Website、UI 组件、游戏开发、数据可视化、SVG、Web App、移动端等多个子类别,每个子类别均有独立排行。

本页展示的是 Code Categories 综合榜,即将所有子类别的用户投票混合汇总后,统一用 Bradley-Terry 模型(类 Elo 算法)计算出的综合排名。每票等权,不对各子类别做加权处理,因此投票量较大的子类别(如 Website)对综合分数的影响更大。得分越高,代表模型在设计代码生成场景下的综合人类偏好越强。

常见问题 (FAQ)

01

什么是 Arcada Labs Code Categories Arena?

Arcada Labs Code Categories Arena 是专注于设计代码生成能力的匿名评测平台,覆盖 Website、UI 组件、游戏开发、数据可视化等多个代码生成子类别,并将投票汇总为综合榜单。

02

Arcada Code Arena 与 LMArena Coding Arena 有什么区别?

LMArena Coding Arena 主要评测通用编程能力,例如代码生成、调试和算法实现;Arcada Code Arena 专注于具有视觉呈现效果的前端设计代码,例如 HTML 页面、交互 UI、图表、SVG 和原型。

03

排名方法论是什么?

Arcada Labs 将各代码子类别的原始投票混合后运行 Bradley-Terry 模型。每票等权,不按子类别单独加权,因此投票量较大的子类别会对综合分数产生更大影响。

04

哪类模型在设计代码场景表现更好?

具备强视觉理解和前端代码生成能力的大模型通常表现更好。针对 UI 和代码生成优化的专项模型,在布局、交互和视觉细节任务上也可能有突出表现。