أطلقت Liquid AI نموذج LFM2.5-VL-3B، وهو نموذج رؤية ولغة يحتوي على 3.1 مليار معامِل صُمّم لنشره بكفاءة على الأجهزة الطرفية. يقرأ النموذج الشاشات الرقمية عبر بيئات الهاتف المحمول والويب وسطح المكتب، ويربط الكائنات بإحداثياتها، ويحلل المستندات، وينفذ استدعاءات الأدوات من مدخلات نصية أو صور.
- الأداء: يحقق متوسط 69.4 عبر 28 معيارًا للرؤية، متساويًا مع InternVL-3.5-4B ومتخلفًا عن Qwen3.5-4B بنقطتين فقط (0.7).
- القدرات الجديدة: يقدم استدعاء الدوال (ToolSandbox 59.5، BFCL v4 32.5) وتحسين الربط المكاني (RefCOCO-avg 87.9).
- الكفاءة: يتسع لـ ~3 جيجابايت من الذاكرة، ويترجم 228 رمزًا/ثانية على Apple M5 Max.
- الترخيص: استخدام تجاري مجاني للشركات ذات الإيرادات السنوية أقل من 10 ملايين دولار؛ يجب على المؤسسات الأكبر تفاوضًا على ترخيص.
النموذج غير قادر على الاستدلال المنطقي للحفاظ على زمن استجابة منخفض، ويُوزع بصيغ أصلية وGGUF وONNX وMLX مع دعم لمكتبات llama.cpp وMLX وvLLM وSGLang ومحركات ONNX.