Бенчмарк · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| Дата | Модель | Результат | Источник |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI выпустила LFM2.5-VL-3B: 3-миллиардную модель для распознавания изображений и текста на устройстве с поддержкой вызова инструментов |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B улучшает понимание экрана и вызов функций для развёртывания на периферии |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI выпустила Pokee-Isaac 28B — модель с контекстом на 10M токенов для развёртывания в контролируемой среде |
| 2025-08-06 | GLM-4.5 | 90.6% | Zhipu AI выпустила модели GLM-4.5, сопоставимые с Claude и DeepSeek |
| 2025-08-06 | GLM-4.5-Air | 76.4% | Zhipu AI выпустила модели GLM-4.5, сопоставимые с Claude и DeepSeek |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | Семейство Falcon3 выпускает пять открытых моделей с улучшенными возможностями в науке, математике и программировании |