Liquid AI ने LFM2.5-VL-3B जारी किया है, जो कुशल ऑन-डिवाइज तैनाती के लिए डिज़ाइन किया गया एक 3.1B-पैरामीटर विजन-लैंग्वेज मॉडल है। यह मॉडल मोबाइल, वेब और डेस्कटॉप वातावरण में डिजिटल स्क्रीन को पढ़ता है, वस्तुओं को निर्देशांक से जोड़ता है, दस्तावेज़ों को पार्स करता है, और टेक्स्ट या इमेज इनपुट से टूल कॉल निष्पादित करता है।
- प्रदर्शन: 28 विजन बेंचमार्क पर औसतन 69.4 के साथ, InternVL-3.5-4B के बराबर और Qwen3.5-4B से 0.7 अंक पीछे।
- नई क्षमताएँ: फंक्शन कॉलिंग (ToolSandbox 59.5, BFCL v4 32.5) और बेहतर ग्रौंडिंग (RefCOCO-avg 87.9) पेश करता है।
- दक्षता: ~3 GB मेमोरी में फिट होता है, Apple M5 Max पर 228 tok/s डिकोड करता है।
- लाइसेंसिंग: $10M वार्षिक राजस्व से कम कंपनियों के लिए मुफ्त व्यावसायिक उपयोग; बड़ी उद्योगों को लाइसेंस की बातचीत करनी होगी।
मॉडल कम लेटेंसी बनाए रखने के लिए नॉन-रीजनिंग है और llama.cpp, MLX, vLLM, SGLang, और ONNX रनटाइम के साथ नेटिव, GGUF, ONNX, और MLX फॉर्मेट में उपलब्ध है।