Benchmark · agentic

Berkeley Function-Calling Leaderboard

6 نتائج 5 نماذج

Berkeley's function/tool-calling accuracy leaderboard.

0 24 48 72 96 2024-12-17 2025-10-15 2026-08-13 Falcon3-10B-Instruct · 86.3 · 2024-12-17 GLM-4.5 · 90.6 · 2025-08-06 GLM-4.5-Air · 76.4 · 2025-08-06 Pokee-Isaac 28B · 70.9 · 2026-08-08 LFM2.5-VL-3B · 32.5 · 2026-08-12 LFM2.5-VL-3B · 32.5 · 2026-08-13
Falcon3-10B-Instruct GLM-4.5 GLM-4.5-Air Pokee-Isaac 28B LFM2.5-VL-3B
الجدول الزمني
التاريخ النموذج النتيجة المصدر
2026-08-13 LFM2.5-VL-3B 32.5% Liquid AI تطلق LFM2.5-VL-3B، نموذج رؤية ولغة بحجم 3 مليار معامِل يعمل على الجهاز مع استدعاء الأدوات
2026-08-12 LFM2.5-VL-3B 32.5% LFM2.5-VL-3B يحسّن فهم الشاشة واستدعاء الوظائف للنشر على الحافة
2026-08-08 Pokee-Isaac 28B 70.94% Pokee AI تطلق Pokee-Isaac 28B، نموذج سياق بـ 10 ملايين رمز للنشر ضمن الحدود المحددة
2025-08-06 GLM-4.5 90.6% تشيبو آي تطلق نماذج GLM-4.5 التي توازي كلود وديبسيك
2025-08-06 GLM-4.5-Air 76.4% تشيبو آي تطلق نماذج GLM-4.5 التي توازي كلود وديبسيك
2024-12-17 Falcon3-10B-Instruct 86.3% عائلة Falcon3 تطلق خمسة نماذج مفتوحة المصدر بقدرات محسّنة في العلوم والرياضيات والبرمجة