Benchmark · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| Data | Modelo | Pontuação | Fonte |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI lança LFM2.5-VL-3B, um modelo de visão e linguagem de 3B para dispositivos móveis com chamada de ferramentas |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B melhora a compreensão de tela e a chamada de funções para implantação em dispositivos de borda |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI lança Pokee-Isaac 28B, um modelo de contexto de 10M de tokens para implantação em limites definidos |
| 2025-08-06 | GLM-4.5 | 90.6% | Zhipu AI lança modelos GLM-4.5 que igualam Claude e DeepSeek |
| 2025-08-06 | GLM-4.5-Air | 76.4% | Zhipu AI lança modelos GLM-4.5 que igualam Claude e DeepSeek |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | Família Falcon3 lança cinco modelos abertos com capacidades aprimoradas de ciência, matemática e código |