Benchmark · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| 日期 | 模型 | 得分 | 来源 |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI 发布 LFM2.5-VL-3B,一款支持工具调用的 3B 端侧视觉语言模型 |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B提升屏幕理解与函数调用能力,助力边缘部署 |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI 发布 Pokee-Isaac 28B,一款面向边界内部署的 10M token 上下文模型 |
| 2025-08-06 | GLM-4.5 | 90.6% | 智谱AI发布与Claude和DeepSeek匹敌的GLM-4.5模型 |
| 2025-08-06 | GLM-4.5-Air | 76.4% | 智谱AI发布与Claude和DeepSeek匹敌的GLM-4.5模型 |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | Falcon3 系列发布五款开源模型,提升科学、数学和代码能力 |