벤치마크 · agentic

Berkeley Function-Calling Leaderboard

6 결과 5 모델

Berkeley's function/tool-calling accuracy leaderboard.

0 24 48 72 96 2024-12-17 2025-10-15 2026-08-13 Falcon3-10B-Instruct · 86.3 · 2024-12-17 GLM-4.5 · 90.6 · 2025-08-06 GLM-4.5-Air · 76.4 · 2025-08-06 Pokee-Isaac 28B · 70.9 · 2026-08-08 LFM2.5-VL-3B · 32.5 · 2026-08-12 LFM2.5-VL-3B · 32.5 · 2026-08-13
Falcon3-10B-Instruct GLM-4.5 GLM-4.5-Air Pokee-Isaac 28B LFM2.5-VL-3B
타임라인
날짜 모델 점수 출처
2026-08-13 LFM2.5-VL-3B 32.5% Liquid AI가 도구 호출 기능을 갖춘 3B 온디바이스 비전-언어 모델 LFM2.5-VL-3B 출시
2026-08-12 LFM2.5-VL-3B 32.5% LFM2.5-VL-3B가 엣지 배포를 위한 화면 이해 및 함수 호출을 개선
2026-08-08 Pokee-Isaac 28B 70.94% Pokee AI, 경계 내 배포용 10M 토큰 컨텍스트 모델 Pokee-Isaac 28B 출시
2025-08-06 GLM-4.5 90.6% 지푸 AI가 Claude와 DeepSeek에 맞먹는 GLM-4.5 모델 출시
2025-08-06 GLM-4.5-Air 76.4% 지푸 AI가 Claude와 DeepSeek에 맞먹는 GLM-4.5 모델 출시
2024-12-17 Falcon3-10B-Instruct 86.3% Falcon3 패밀리가 향상된 과학, 수학, 코드 능력을 갖춘 다섯 가지 오픈 모델을 출시