Benchmark · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| التاريخ | النموذج | النتيجة | المصدر |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI تطلق LFM2.5-VL-3B، نموذج رؤية ولغة بحجم 3 مليار معامِل يعمل على الجهاز مع استدعاء الأدوات |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B يحسّن فهم الشاشة واستدعاء الوظائف للنشر على الحافة |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI تطلق Pokee-Isaac 28B، نموذج سياق بـ 10 ملايين رمز للنشر ضمن الحدود المحددة |
| 2025-08-06 | GLM-4.5 | 90.6% | تشيبو آي تطلق نماذج GLM-4.5 التي توازي كلود وديبسيك |
| 2025-08-06 | GLM-4.5-Air | 76.4% | تشيبو آي تطلق نماذج GLM-4.5 التي توازي كلود وديبسيك |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | عائلة Falcon3 تطلق خمسة نماذج مفتوحة المصدر بقدرات محسّنة في العلوم والرياضيات والبرمجة |