Benchmark · agentic

Berkeley Function-Calling Leaderboard

6 परिणाम 5 मॉडल

Berkeley's function/tool-calling accuracy leaderboard.

0 24 48 72 96 2024-12-17 2025-10-15 2026-08-13 Falcon3-10B-Instruct · 86.3 · 2024-12-17 GLM-4.5 · 90.6 · 2025-08-06 GLM-4.5-Air · 76.4 · 2025-08-06 Pokee-Isaac 28B · 70.9 · 2026-08-08 LFM2.5-VL-3B · 32.5 · 2026-08-12 LFM2.5-VL-3B · 32.5 · 2026-08-13
Falcon3-10B-Instruct GLM-4.5 GLM-4.5-Air Pokee-Isaac 28B LFM2.5-VL-3B
समयरेखा
तारीख़ मॉडल स्कोर स्रोत
2026-08-13 LFM2.5-VL-3B 32.5% Liquid AI ने LFM2.5-VL-3B जारी किया, जो टूल कॉलिंग के साथ एक 3B ऑन-डिवाइज विजन-लैंग्वेज मॉडल है
2026-08-12 LFM2.5-VL-3B 32.5% LFM2.5-VL-3B एज डिप्लॉयमेंट के लिए स्क्रीन समझ और फंक्शन कॉलिंग में सुधार करता है
2026-08-08 Pokee-Isaac 28B 70.94% Pokee AI ने Pokee-Isaac 28B जारी किया, जो इन-बाउंड्री डिप्लॉयमेंट के लिए 10M-टोकन संदर्भ मॉडल है
2025-08-06 GLM-4.5 90.6% ज़ीपू एआई ने क्लॉड और डीपसीक के बराबर GLM-4.5 मॉडल जारी किए
2025-08-06 GLM-4.5-Air 76.4% ज़ीपू एआई ने क्लॉड और डीपसीक के बराबर GLM-4.5 मॉडल जारी किए
2024-12-17 Falcon3-10B-Instruct 86.3% Falcon3 परिवार ने बेहतर विज्ञान, गणित और कोड क्षमताओं के साथ पांच ओपन मॉडल जारी किए