DataLearner 标志

Artificial Analysis Intelligence Index AI模型智能指数排行榜

Artificial Analysis Intelligence Index v4.0 综合了10项权威评测基准(GDPval-AA、Terminal-Bench、GPQA Diamond、SciCode等),从数学、科学、编程、推理等多维度对AI模型进行全面评估和排名。

榜首模型

Claude Fable 5.1

最高得分

53

模型数量

270

数据版本

2026年09月22日

数据来源: Artificial Analysis

榜单历史快照月份:

排名总表

排名模型名称智能指数机构
AnthropicClaude Fable 5.1Anthropic53Anthropic
AnthropicClaude Fable 5.1Anthropic53Anthropic
OpenAIGPT-6 Astra (max)OpenAI53OpenAI
4OpenAIGPT-6 Astra (xhigh)OpenAI52OpenAI
5AnthropicClaude Fable 5.1Anthropic51Anthropic
6OpenAIGPT-6 Astra (high)OpenAI51OpenAI
7AnthropicClaude Opus 5 (max)Anthropic51Anthropic
8AnthropicClaude Opus 5 (xhigh)Anthropic50Anthropic
9OpenAIGPT-6 Astra (medium)OpenAI50OpenAI
10AnthropicClaude Fable 5.1Anthropic49Anthropic
11AnthropicClaude Opus 5 (high)Anthropic48Anthropic
12MetaMuse Spark 1.3 (max)Meta48Meta
13OpenAIGPT-5.6 Sol (max)OpenAI47OpenAI
14AnthropicClaude Fable 5.1Anthropic47Anthropic
15SpaceXAIGrok 4.7 (xhigh)SpaceXAI46SpaceXAI
16SpaceXAIGrok 4.7 (high)SpaceXAI46SpaceXAI
17OpenAIGPT-6 Astra (low)OpenAI46OpenAI
18AlibabaQwen3.8 Max (0902)Alibaba45Alibaba
19MetaMuse Spark 1.3 (xhigh)Meta45Meta
20AnthropicClaude Opus 5 (medium)Anthropic45Anthropic
21智谱AIGLM-5.3 (max)智谱AI45智谱AI
22xAIGrok 4.6 (high)xAI44xAI
23xAIGrok 4.6 (xhigh)xAI44xAI
24OpenAIGPT-5.6 Sol (xhigh)OpenAI44OpenAI
25StepFunStep 5 PreviewStepFun44StepFun
26Moonshot AIKimi K3 (max)Moonshot AI44Moonshot AI
27xAIGrok 4.6 (medium)xAI43xAI
28OpenAIGPT-5.6 Sol (high)OpenAI42OpenAI
29OpenAIGPT-5.6 Terra (max)OpenAI42OpenAI
30Z AIGLM-5.3-FlashZ AI42Z AI
31GoogleGemini 3.8 Flash (high)Google41Google
32AlibabaQwen3.8 2.4T A95BAlibaba40Alibaba
33AlibabaQwen3.8-Flash-NextAlibaba40Alibaba
34GoogleGemini 3.8 Flash (medium)Google40Google
35DeepSeekDeepSeek V4.1 Flash (max)DeepSeek39DeepSeek
36AnthropicClaude Opus 5 (low)Anthropic39Anthropic
37OpenAIGPT-5.6 Sol (medium)OpenAI39OpenAI
38AnthropicClaude Sonnet 5 (max)Anthropic38Anthropic
39OpenAIGPT-5.6 Terra (xhigh)OpenAI38OpenAI
40OpenAIGPT-5.6 Luna (max)OpenAI37OpenAI
41DeepSeek-AIDeepSeek-V4-Pro (max)DeepSeek-AI36DeepSeek-AI
42Agnes 3.0 FlashSapiens AI36Sapiens AI
43Agnes 2.5 Pro BetaSapiens AI35Sapiens AI
44xAIGrok 4.6 (low)xAI35xAI
45DeepSeekDeepSeek V4 Flash Vision (max)DeepSeek35DeepSeek
46OpenAIGPT-5.6 Luna (xhigh)OpenAI35OpenAI
47Moonshot AIKimi K3 (low)Moonshot AI34Moonshot AI
48AnthropicClaude Sonnet 5 (xhigh)Anthropic34Anthropic
49OpenAIGPT-5.6 Terra (high)OpenAI34OpenAI
50阿里巴巴Qwen3.8-27B (xhigh)阿里巴巴34阿里巴巴
51Motif 3Motif Technologies34Motif Technologies
52OpenAIGPT-5.6 Sol (low)OpenAI33OpenAI
53GoogleGemini 3.8 Flash (low)Google33Google
54OpenAIGPT-5.3 Codex (xhigh)OpenAI33OpenAI
55Motif 3 (Beta)Motif Technologies32Motif Technologies
56OpenAIGPT-5.6 Luna (high)OpenAI32OpenAI
57AnthropicClaude Sonnet 5 (high)Anthropic32Anthropic
58K2 Horizon 375B A23BMBZUAI Institute of Foundation Models31MBZUAI Institute of Foundation Models
59Apodex 1.1Apodex30Apodex
60OpenAIGPT-5.6 Terra (medium)OpenAI30OpenAI
61Google DeepMindGemini 3.1 Pro PreviewGoogle DeepMind30Google DeepMind
62MiniMaxAIMiniMax M3MiniMaxAI29MiniMaxAI
63OpenAIGPT-5.6 Sol (non-reasoning)OpenAI28OpenAI
64Nex-N2-ProNex AGI28Nex AGI
65Solar Pro 4Upstage28Upstage
66AnthropicClaude Sonnet 5 (medium)Anthropic28Anthropic
67Inkling SmallThinking Machines28Thinking Machines
68阿里巴巴Qwen3.8-27B (medium)阿里巴巴28阿里巴巴
69OpenAIGPT-5.6 Terra (low)OpenAI27OpenAI
70JT-4.1 Flash 236B A21BChina Mobile27China Mobile
71Agnes 2.5 Pro AlphaSapiens AI27Sapiens AI
72Quasar 438B (max)Multiverse Computing27Multiverse Computing
73阿里巴巴Qwen3.8-27B (low)阿里巴巴26阿里巴巴
74OpenAIGPT-5.5 InstantOpenAI26OpenAI
75MiMo-V2.5-ProXiaomi26Xiaomi
76Moonshot AIKimi K2.7 CodeMoonshot AI26Moonshot AI
77K2 Horizon MoVA 36B A4BInstitute of Foundation Models25Institute of Foundation Models
78腾讯AI实验室Hy3腾讯AI实验室25腾讯AI实验室
79MiMo-V2.5Xiaomi25Xiaomi
80阿里巴巴Qwen3.7-Plus阿里巴巴25阿里巴巴
81OpenAIGPT-5.6 Luna (medium)OpenAI25OpenAI
82InklingThinking Machines Lab25Thinking Machines Lab
83Ling 3.0 FlashInclusionAI25InclusionAI
84Solar Open2 250BUpstage25Upstage
85Ling-3.0-flash-VLInclusionAI25InclusionAI
86AnthropicClaude Sonnet 5 (low)Anthropic24Anthropic
87AnthropicClaude Sonnet 5 (non-reasoning)Anthropic23Anthropic
88NVIDIANemotron 3 UltraNVIDIA23NVIDIA
89阿里巴巴Qwen2-57B-A14B阿里巴巴23阿里巴巴
90Ling-3.0-flash-FinInclusionAI23InclusionAI
91Google DeepMindGemini 2.0 Flash ExperimentalGoogle DeepMind22Google DeepMind
92阿里巴巴Qwen3.8-27B阿里巴巴22阿里巴巴
93Google DeepMindGemini 3.5 Flash-LiteGoogle DeepMind22Google DeepMind
94G9v3-39A5BAI9Stars22AI9Stars
95KAT-Coder-Pro V2KwaiKAT22KwaiKAT
96AlibabaQwen3.5 397B A17B (Non-reasoning)Alibaba21Alibaba
97OpenAIGPT-5.6 Luna (low)OpenAI21OpenAI
98OpenAIGPT-5.6 Terra (non-reasoning)OpenAI21OpenAI
99K2 Horizon 7BInstitute of Foundation Models21Institute of Foundation Models
100阿里巴巴Qwen3.5-Omni-Plus阿里巴巴20阿里巴巴
101OpenAIOpenAI o3OpenAI20OpenAI
102K-EXAONE 2.0LG AI Research20LG AI Research
103StepFunAIStep 3.7 FlashStepFunAI19StepFunAI
104LongCat 2.0LongCat19LongCat
105Google DeepMindGemma 4 31BGoogle DeepMind19Google DeepMind
106JT-35B-FlashChina Mobile19China Mobile
107阿里巴巴Qwen3.5-397B-A17B阿里巴巴18阿里巴巴
108MiMo-V2.5-Pro (Non-reasoning)Xiaomi18Xiaomi
109阿里巴巴Qwen3.6-35B-A3B阿里巴巴18阿里巴巴
110AlibabaQwen3.5 122B A10B (Non-reasoning)Alibaba18Alibaba
111Facebook AI研究实验室Muse Glimmer-30B (high)Facebook AI研究实验室17Facebook AI研究实验室
112ByteDance SeedDoubao Seed CodeByteDance Seed17ByteDance Seed
113AnthropicHaiku 4.5Anthropic17Anthropic
114Google DeepMindGemma 4 26B A4BGoogle DeepMind17Google DeepMind
115Ring-2.6-1TInclusionAI17InclusionAI
116K2 Horizon 3.7BInstitute of Foundation Models16Institute of Foundation Models
117阿里巴巴Qwen3.5-122B-A10B阿里巴巴16阿里巴巴
118OpenAIGPT-5.6 Luna (non-reasoning)OpenAI16OpenAI
119AnthropicHaiku 4.5 (non-reasoning)Anthropic15Anthropic
120Ling 3.0 TinyInclusionAI15InclusionAI
121AlibabaQwen3.6 35B A3B (Non-reasoning)Alibaba15Alibaba
122Granite 4.2 30BIBM15IBM
123百度ERNIE 5.0 Thinking Preview百度14百度
124MistralAIMistral Medium 3.5MistralAI14MistralAI
125GoogleGemma 4 12BGoogle14Google
126亚马逊Nova 2 Pro(Preview) (medium)亚马逊14亚马逊
127GoogleGemma 4 31B (Non-reasoning)Google14Google
128Mercury 2Inception14Inception
129阿里巴巴Qwen3.5-9B阿里巴巴14阿里巴巴
130亚马逊Nova 2 Omni(Preview) (medium)亚马逊14亚马逊
131Apriel-v1.6-15B-ThinkerServiceNow13ServiceNow
132亚马逊Nova 2 Lite (high)亚马逊13亚马逊
133AlibabaQwen3.5 9B (Non-reasoning)Alibaba13Alibaba
134EXAONE 4.5 33BLG AI Research13LG AI Research
135CohereCommand A+Cohere13Cohere
136GoogleGemma 4 26B A4B (Non-reasoning)Google13Google
137AlibabaQwen3.5 4BAlibaba13Alibaba
138NVIDIANemotron 3.5 LightningNVIDIA13NVIDIA
139NVIDIANemotron 3 SuperNVIDIA13NVIDIA
140亚马逊Nova 2 Pro(Preview) (low)亚马逊13亚马逊
141亚马逊Nova 2 Lite (medium)亚马逊12亚马逊
142阿里巴巴Qwen3.5-Omni-Flash阿里巴巴12阿里巴巴
143MiniCPM5-2BOpenBMB12OpenBMB
144JT-MINIChina Mobile12China Mobile
145MistralMagistral Medium 1.2Mistral12Mistral
146亚马逊Nova 2 Lite (low)亚马逊12亚马逊
147HyperNova 60B 2605 (high)Multiverse Computing12Multiverse Computing
148NVIDIANemotron Cascade 2 30B A3BNVIDIA12NVIDIA
149OpenAIGPT OSS 120B (high)OpenAI12OpenAI
150K2 Think V2MBZUAI11MBZUAI
151LongCat Flash LiteLongCat11LongCat
152HyperCLOVA X SEED Think (32B)Naver11Naver
153MistralMistral Small 4Mistral11Mistral
154AlibabaQwen3 Next 80B A3B (Reasoning)Alibaba11Alibaba
155亚马逊Nova 2 Omni(Preview) (low)亚马逊11亚马逊
156Granite 4.2 8BIBM11IBM
157Mi:dm K 2.5 ProKorea Telecom11Korea Telecom
158G9v3-3BAI9Stars11AI9Stars
159Trinity Large ThinkingArcee AI11Arcee AI
160AlibabaQwen3.5 4B (Non-reasoning)Alibaba11Alibaba
161INTELLECT-3Prime Intellect11Prime Intellect
162Solar Open 100BUpstage10Upstage
163阿里巴巴Qwen3-Omni-30B-A3B阿里巴巴10阿里巴巴
164OpenAIGPT OSS 120B (low)OpenAI10OpenAI
165Facebook AI研究实验室Llama 4 MaverickFacebook AI研究实验室10Facebook AI研究实验室
166AmazonNova 2.0 Pro Preview (Non-reasoning)Amazon10Amazon
167OpenAIGPT OSS 20B (low)OpenAI10OpenAI
168CohereNorth Mini CodeCohere10Cohere
169K2-V2 (high)MBZUAI10MBZUAI
170阿里巴巴Qwen3-Next阿里巴巴10阿里巴巴
171GoogleDiffusionGemma 26B A4BGoogle10Google
172GoogleGemma 4 12B (Non-reasoning)Google9Google
173MistralAIMistral Large 3MistralAI9MistralAI
174阿里巴巴Qwen3-Coder-Next阿里巴巴9阿里巴巴
175Motif-2-12.7BMotif Technologies9Motif Technologies
176AmazonNova PremierAmazon9Amazon
177Granite 4.2 3BIBM9IBM
178K2-V2 (medium)MBZUAI9MBZUAI
179MetaLlama Nemotron Super 49B v1.5Meta9Meta
180MistralMistral Small 4 (Non-reasoning)Mistral9Mistral
181Tri-21B-ThinkTrillion Labs9Trillion Labs
182OpenAIGPT OSS 20B (high)OpenAI9OpenAI
183Google DeepMindGemma 4 E4BGoogle DeepMind9Google DeepMind
184NVIDIANemotron 3 NanoNVIDIA9NVIDIA
185OpenBMBMiniCPM5-1BOpenBMB9OpenBMB
186Sarvam 105B (high)Sarvam9Sarvam
187AmazonNova 2.0 Lite (Non-reasoning)Amazon9Amazon
188MiniCPM5-1B (Non-reasoning)OpenBMB9OpenBMB
189MistralDevstral 2Mistral9Mistral
190MistralMagistral Small 1.2Mistral9Mistral
191Nanbeige4.1-3BNanbeige8Nanbeige
192LFM2.5-2.6BLiquid AI8Liquid AI
193EXAONE 4.0 32BLG AI Research8LG AI Research
194AmazonNova 2.0 Omni (Non-reasoning)Amazon8Amazon
195Facebook AI研究实验室Llama 4 ScoutFacebook AI研究实验室8Facebook AI研究实验室
196Hermes 4 70BNous Research8Nous Research
197Falcon-H1R-7BTII UAE8TII UAE
198Google DeepMindGemma 4 E2BGoogle DeepMind8Google DeepMind
199AlibabaQwen3 Omni 30B A3B (Reasoning)Alibaba8Alibaba
200StepFunStep3 VL 10BStepFun8StepFun
201Facebook AI研究实验室Llama3.3-70B-InstructFacebook AI研究实验室8Facebook AI研究实验室
202MistralDevstral Small 2Mistral8Mistral
203NVIDIALlama Nemotron UltraNVIDIA8NVIDIA
204百度ERNIE-4.5-300B-A47B百度8百度
205Hermes 4 405BNous Research7Nous Research
206NVIDIANVIDIA Nemotron Nano 12B v2 VLNVIDIA7NVIDIA
207GoogleGemma 4 E4B (Non-reasoning)Google7Google
208NVIDIANVIDIA Nemotron Nano 9B V2NVIDIA7NVIDIA
209Hermes 4 405B (Non-reasoning)Nous Research7Nous Research
210NVIDIANemotron 3 Nano 4BNVIDIA7NVIDIA
211NVIDIALlama Nemotron Super 49B v1.5 (Non-reasoning)NVIDIA7NVIDIA
212K2-V2 (low)MBZUAI7MBZUAI
213KimiKimi Linear 48B A3B InstructKimi7Kimi
214Facebook AI研究实验室Llama3.1-405BFacebook AI研究实验室7Facebook AI研究实验室
215LFM2.5-8B-A1BLiquid AI7Liquid AI
216Ring-flash-2.0InclusionAI7InclusionAI
217Olmo 3.1 32B ThinkAI27AI2
218CohereAIC4AI Command A (202503)CohereAI7CohereAI
219AlibabaQwen3.5 2BAlibaba7Alibaba
220NVIDIALlama 3.1 Nemotron 70BNVIDIA7NVIDIA
221NVIDIANemotron 3 Nano (Non-reasoning)NVIDIA7NVIDIA
222NVIDIANVIDIA Nemotron Nano 9B V2 (Non-reasoning)NVIDIA7NVIDIA
223Hermes 4 70B (Non-reasoning)Nous Research7Nous Research
224Sarvam 30B (high)Sarvam7Sarvam
225Olmo 3.1 32B InstructAI26AI2
226GoogleGemma 4 E2B (Non-reasoning)Google6Google
227PerplexityR1 1776Perplexity6Perplexity
228Facebook AI研究实验室Llama 3.2-Vision-90BFacebook AI研究实验室6Facebook AI研究实验室
229Celeris-1Celeris6Celeris
230Microsoft AzurePhi-4-mini-instruct (3.8B)Microsoft Azure6Microsoft Azure
231EXAONE 4.0 32B (Non-reasoning)LG AI Research6LG AI Research
232AlibabaQwen3.5 2B (Non-reasoning)Alibaba6Alibaba
233AlibabaQwen3.5 0.8BAlibaba6Alibaba
234DeepHermes 3 - Mistral 24BNous Research6Nous Research
235Jamba 1.7 LargeAI21 Labs6AI21 Labs
236Granite 4.0 H SmallIBM6IBM
237MistralAIMinistral 3 14BMistralAI6MistralAI
238阿里巴巴Qwen3-Omni-30B-A3B阿里巴巴6阿里巴巴
239LFM2 24B A2BLiquid AI6Liquid AI
240Microsoft AzurePhi-4-reasoningMicrosoft Azure6Microsoft Azure
241亚马逊Amazon Nova Micro亚马逊6亚马逊
242NVIDIANVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)NVIDIA6NVIDIA
243Microsoft AzurePhi-4-multimodal-instruct Microsoft Azure6Microsoft Azure
244MiniCPM-V 4.6 1.3BOpenBMB6OpenBMB
245Jamba Reasoning 3BAI21 Labs6AI21 Labs
246Reka Flash 3Reka AI6Reka AI
247Olmo 3 7B ThinkAI26AI2
248Molmo 7B-DAllen Institute for AI6Allen Institute for AI
249MistralAIMinistral 3 8BMistralAI5MistralAI
250Facebook AI研究实验室Llama 3.2-Vision-11BFacebook AI研究实验室5Facebook AI研究实验室
251AlibabaQwen3.5 0.8B (Non-reasoning)Alibaba5Alibaba
252Exaone 4.0 1.2BLG AI Research5LG AI Research
253Olmo 3 7BAI25AI2
254Exaone 4.0 1.2B (Non-reasoning)LG AI Research5LG AI Research
255LFM2.5-1.2B-ThinkingLiquid AI5Liquid AI
256Jamba 1.7 MiniAI21 Labs5AI21 Labs
257LFM2.5-1.2B-InstructLiquid AI5Liquid AI
258Granite 4.0 H 1BIBM5IBM
259Google DeepMindGemma 3-270MGoogle DeepMind5Google DeepMind
260Apertus 70B InstructSwiss AI5Swiss AI
261Granite 4.0 MicroIBM5IBM
262DeepHermes 3 - Llama-3.1 8BNous Research5Nous Research
263Molmo2-8BAI25AI2
264MistralMinistral 3 3BMistral5Mistral
265LFM2.5-VL-1.6BLiquid AI5Liquid AI
266Granite 4.0 350MIBM5IBM
267CohereTiny Aya GlobalCohere5Cohere
268Apertus 8B InstructSwiss AI5Swiss AI
269Granite 4.0 H 350MIBM5IBM
270K2 Horizon 0.9BInstitute of Foundation Models3Institute of Foundation Models

数据仅供参考,以官方来源为准。模型名称旁的链接可跳转到 DataLearner 模型详情页。

评测基准组成(Intelligence Index v4.0)

Intelligence Index 综合10项严格的评测基准,全面衡量AI模型能力,避免单一维度的过拟合。

GDPval-AA
智能体真实任务
τ²-Bench
智能体工具调用
Terminal-Bench
智能体编程
SciCode
编程能力
AA-LCR
长上下文推理
AA-Omniscience
知识与幻觉检测
IFBench
指令遵循
Humanity's Last Exam
推理与知识
GPQA Diamond
科学推理
CritPt
物理推理

常见问题 (FAQ)

什么是 Artificial Analysis Intelligence Index?▼
Artificial Analysis Intelligence Index v4.0 是一个综合评测指数,聚合了10项具有挑战性的评估——涵盖数学、科学、编程、智能体任务和推理——以全面衡量AI能力。它旨在防止单一维度的过拟合,提供一个统一分数来追踪模型进步。
智能指数是如何计算的?▼
该指数综合了10项评测的分数:GDPval-AA(智能体真实任务)、τ²-Bench(工具调用)、Terminal-Bench Hard(智能体编程)、SciCode(编程)、AA-LCR(长上下文推理)、AA-Omniscience(知识与幻觉检测)、IFBench(指令遵循)、Humanity's Last Exam(推理)、GPQA Diamond(科学推理)和 CritPt(物理推理)。所有测试由 Artificial Analysis 在标准化硬件上独立运行。
这与 LMArena 排行榜有什么区别?▼
LMArena 排名基于众包用户投票(盲测A/B对比的Elo评分),反映主观的人类偏好。而 Artificial Analysis Intelligence Index 使用标准化的自动评测基准进行客观评分,衡量特定领域的技术能力。两者各有价值——LMArena 捕捉真实用户体验,而 AA Intelligence Index 提供可复现的技术测量。
在哪里可以找到原始数据?▼
原始排行榜和详细方法论可在 artificialanalysis.ai 查看。Intelligence Index 的方法论详见 Intelligence Index 页面。