Berkeley Function Calling 大模型工具使用排行榜
Berkeley Function Calling Leaderboard是衡量大模型工具使用或函数调用能力的权威排行榜。
榜首模型
GLM-4.6 (FC thinking)
最高得分
-
模型数量
109
数据版本
20260808
数据来源: Berkeley官方网站
排名总表
| 排名 | 模型名称 | 综合准确率 | 请求成本($) | 时延(秒) | AST准确率(Non-Live) | 实时任务准确率(Live) | 相关性检测 | 发布者 | 开源情况 |
|---|---|---|---|---|---|---|---|---|---|
| 4 | GLM-4.6 (FC thinking)Zhipu AI | 72.38 | 4.64 | 4.34 | 87.56 | 80.90 | 75.00 | Zhipu AI | MIT |
| 11 | Moonshotai-Kimi-K2-Instruct (FC)MoonshotAI | 59.06 | 6.19 | 6.40 | 81.60 | 78.68 | 75.00 | MoonshotAI | modified-mit |
| 14 | DeepSeek-V3.2-Exp (Prompt + Thinking)DeepSeek | 56.73 | 57.75 | 37.89 | 85.52 | 76.02 | 93.75 | DeepSeek | MIT |
| 19 | DeepSeek-V3.2-Exp (FC)DeepSeek | 54.12 | 6.71 | 5.83 | 34.85 | 53.66 | 37.50 | DeepSeek | MIT |
| 23 | Qwen3-235B-A22B-Instruct-2507 (Prompt)Qwen | 52.15 | 3.12 | 2.56 | 90.33 | 78.68 | 93.75 | Qwen | apache-2.0 |
| 29 | Qwen3-32B (FC)Qwen | 48.71 | 153.08 | 169.87 | 88.77 | 82.01 | 93.75 | Qwen | apache-2.0 |
| 31 | Qwen3-235B-A22B-Instruct-2507 (FC)Qwen | 47.99 | 2.50 | 2.57 | 37.40 | 68.91 | 87.50 | Qwen | apache-2.0 |
| 33 | Qwen3-32B (Prompt)Qwen | 46.78 | 199.47 | 167.54 | 90.27 | 82.01 | 81.25 | Qwen | apache-2.0 |
| 39 | Qwen3-8B (FC)Qwen | 42.57 | 43.32 | 51.36 | 87.58 | 80.53 | 93.75 | Qwen | apache-2.0 |
| 40 | ToolACE-2-8B (FC)Huawei Noah & USTC | 42.44 | 24.43 | 15.95 | 87.10 | 77.42 | 75.00 | Huawei Noah & USTC | Apache-2.0 |
| 41 | Qwen3-30B-A3B-Instruct-2507 (FC)Qwen | 41.39 | 5.62 | 5.95 | 85.77 | 77.94 | 81.25 | Qwen | apache-2.0 |
| 43 | Qwen3-14B (FC)Qwen | 41.03 | 3.38 | 4.50 | 84.94 | 80.01 | 87.50 | Qwen | apache-2.0 |
| 44 | Qwen3-8B (Prompt)Qwen | 40.43 | 63.95 | 54.17 | 88.56 | 80.09 | 75.00 | Qwen | apache-2.0 |
| 47 | Qwen3-14B (Prompt)Qwen | 37.77 | 1.35 | 1.20 | 89.46 | 79.35 | 81.25 | Qwen | apache-2.0 |
| 53 | Qwen3-30B-A3B-Instruct-2507 (Prompt)Qwen | 36.70 | 1.56 | 1.24 | 88.92 | 78.39 | 93.75 | Qwen | apache-2.0 |
| 54 | Qwen3-4B-Instruct-2507 (FC)Qwen | 35.68 | 6.37 | 7.61 | 87.88 | 76.39 | 87.50 | Qwen | apache-2.0 |
| 55 | Qwen3-4B-Instruct-2507 (Prompt)Qwen | 35.52 | 53.66 | 44.70 | 86.44 | 74.69 | 87.50 | Qwen | apache-2.0 |
| 71 | Qwen3-1.7B (FC)Qwen | 28.41 | 4.33 | 5.12 | 82.92 | 74.61 | 81.25 | Qwen | apache-2.0 |
| 92 | Qwen3-0.6B (FC)Qwen | 23.93 | 0.46 | 0.68 | 71.79 | 56.62 | 75.00 | Qwen | apache-2.0 |
| 94 | Qwen3-0.6B (Prompt)Qwen | 22.38 | 3.65 | 3.10 | 70.00 | 49.37 | 75.00 | Qwen | apache-2.0 |
数据仅供参考,以官方来源为准。模型名称旁的链接可跳转到 DataLearner 模型详情页。

