Benchmark · agentic
Berkeley Function-Calling Leaderboard
Berkeley's function/tool-calling accuracy leaderboard.
| Fecha | Modelo | Puntuación | Fuente |
|---|---|---|---|
| 2026-08-13 | LFM2.5-VL-3B | 32.5% | Liquid AI lanza LFM2.5-VL-3B, un modelo de visión y lenguaje de 3B para dispositivos con capacidad de llamada a herramientas |
| 2026-08-12 | LFM2.5-VL-3B | 32.5% | LFM2.5-VL-3B mejora la comprensión de pantallas y la invocación de funciones para despliegue en el borde |
| 2026-08-08 | Pokee-Isaac 28B | 70.94% | Pokee AI lanza Pokee-Isaac 28B, un modelo de contexto de 10M tokens para despliegue en límites definidos |
| 2025-08-06 | GLM-4.5 | 90.6% | Zhipu AI lanza los modelos GLM-4.5 que igualan a Claude y DeepSeek |
| 2025-08-06 | GLM-4.5-Air | 76.4% | Zhipu AI lanza los modelos GLM-4.5 que igualan a Claude y DeepSeek |
| 2024-12-17 | Falcon3-10B-Instruct | 86.3% | La familia Falcon3 lanza cinco modelos abiertos con mejores capacidades en ciencia, matemáticas y código |