DataLearner 标志

Berkeley Function Calling 大模型工具使用排行榜

Berkeley Function Calling Leaderboard是衡量大模型工具使用或函数调用能力的权威排行榜。

榜首模型

GLM-4.6 (FC thinking)

最高得分

-

模型数量

109

数据版本

20260808

数据来源: Berkeley官方网站

榜单历史快照月份:

排名总表

排名模型名称综合准确率请求成本($)时延(秒)AST准确率(Non-Live)实时任务准确率(Live)相关性检测发布者开源情况
4GLM-4.6 (FC thinking)Zhipu AI72.384.644.3487.5680.9075.00Zhipu AIMIT
11MoonshotAIMoonshotai-Kimi-K2-Instruct (FC)MoonshotAI59.066.196.4081.6078.6875.00MoonshotAImodified-mit
14DeepSeekDeepSeek-V3.2-Exp (Prompt + Thinking)DeepSeek56.7357.7537.8985.5276.0293.75DeepSeekMIT
19DeepSeekDeepSeek-V3.2-Exp (FC)DeepSeek54.126.715.8334.8553.6637.50DeepSeekMIT
23Qwen3-235B-A22B-Instruct-2507 (Prompt)Qwen52.153.122.5690.3378.6893.75Qwenapache-2.0
29Qwen3-32B (FC)Qwen48.71153.08169.8788.7782.0193.75Qwenapache-2.0
31Qwen3-235B-A22B-Instruct-2507 (FC)Qwen47.992.502.5737.4068.9187.50Qwenapache-2.0
33Qwen3-32B (Prompt)Qwen46.78199.47167.5490.2782.0181.25Qwenapache-2.0
39Qwen3-8B (FC)Qwen42.5743.3251.3687.5880.5393.75Qwenapache-2.0
40ToolACE-2-8B (FC)Huawei Noah & USTC42.4424.4315.9587.1077.4275.00Huawei Noah & USTCApache-2.0
41Qwen3-30B-A3B-Instruct-2507 (FC)Qwen41.395.625.9585.7777.9481.25Qwenapache-2.0
43Qwen3-14B (FC)Qwen41.033.384.5084.9480.0187.50Qwenapache-2.0
44Qwen3-8B (Prompt)Qwen40.4363.9554.1788.5680.0975.00Qwenapache-2.0
47Qwen3-14B (Prompt)Qwen37.771.351.2089.4679.3581.25Qwenapache-2.0
53Qwen3-30B-A3B-Instruct-2507 (Prompt)Qwen36.701.561.2488.9278.3993.75Qwenapache-2.0
54Qwen3-4B-Instruct-2507 (FC)Qwen35.686.377.6187.8876.3987.50Qwenapache-2.0
55Qwen3-4B-Instruct-2507 (Prompt)Qwen35.5253.6644.7086.4474.6987.50Qwenapache-2.0
71Qwen3-1.7B (FC)Qwen28.414.335.1282.9274.6181.25Qwenapache-2.0
92Qwen3-0.6B (FC)Qwen23.930.460.6871.7956.6275.00Qwenapache-2.0
94Qwen3-0.6B (Prompt)Qwen22.383.653.1070.0049.3775.00Qwenapache-2.0

数据仅供参考,以官方来源为准。模型名称旁的链接可跳转到 DataLearner 模型详情页。