أطلقت Liquid AI نموذج LFM2.5-VL-DSpark المسود، وهو مُعدّ للفك التأملي مصمم لتسريع الاستدلال لنموذج الرؤية واللغة LFM2.5-VL-3B. يلتقط المُعدّ الحالات المخفية من الطبقات الثابتة للنموذج المستهدف لتوليد رموز مرشحة، مضيفاً فقط 280M معامل (فائض بنسبة 8.9%) مع الحفاظ على أبعاد متطابقة عبر الوسائط.
- تصل سرعات تسريع الفك إلى 3.13x على أجهزة Apple M5 Max و2.66x على وحدات معالجة الرسومات NVIDIA H100.
- تتراوح تحسينات زمن الاستجابة من النهاية إلى النهاية بين 1.56x و2.62x على الجهاز، وبين 1.64x و2.27x على وحدة معالجة الرسومات.
- يوفر النموذج دعم تكامل فوري لـ llama.cpp وMLX-VLM وSGLang.
- يسرع الفك التأملي مرحلة الفك فقط؛ بينما تبقى مراحل التعبئة المسبقة وترميز الرؤية هي الاختناقات المحددة بالحوسبة على الأجهزة الطرفية.
يتيح الإطلاق نشر نماذج الرؤية واللغة ذات الأوزان المفتوحة بشكل أسرع عبر بيئات عتدية متنوعة دون تقييد الضبط الدقيق أو التوزيع.