加载中...
加载中...
综合排名与各项 Benchmark 分数持续更新,覆盖 MMLU Pro、HLE、SWE-Bench 等主流评测,帮你快速定位最优模型。
目前没有一个被普遍认可的"AI 模型总排名",所以我们选了两个切入角度不同的榜单放在一起:AA Intelligence Index 汇总标准化评测跑分,衡量客观能力;LMArena 通过真人盲测投票排序,反映实际使用体感。两者对照看,判断会更全面。
我们在此精选了几项有代表性的评测基准,切换即可查看模型在该项上的得分。完整的 60+ 评测基准列表请前往评测基准目录。