Benchmark · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| तारीख़ | मॉडल | स्कोर | स्रोत |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI ने LFM2.5-VL-3B जारी किया, जो टूल कॉलिंग के साथ एक 3B ऑन-डिवाइज विजन-लैंग्वेज मॉडल है |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B एज डिप्लॉयमेंट के लिए स्क्रीन समझ और फंक्शन कॉलिंग में सुधार करता है |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI ने Pokee-Isaac 28B जारी किया, जो इन-बाउंड्री डिप्लॉयमेंट के लिए 10M-टोकन संदर्भ मॉडल है |
| 2025-08-06 | GLM-4.5 | 90.6% | ज़ीपू एआई ने क्लॉड और डीपसीक के बराबर GLM-4.5 मॉडल जारी किए |
| 2025-08-06 | GLM-4.5-Air | 76.4% | ज़ीपू एआई ने क्लॉड और डीपसीक के बराबर GLM-4.5 मॉडल जारी किए |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | Falcon3 परिवार ने बेहतर विज्ञान, गणित और कोड क्षमताओं के साथ पांच ओपन मॉडल जारी किए |