أطلقت Liquid AI نقاط فحص لنماذج مسودة من عائلة LFM2.5—تحديداً LFM2.5-1.2B-Instruct، وLFM2.5-2.6B، وLFM2.5-8B-A1B—التي تستخدم فك التشفير التخميني لتحسين سرعة الاستدلال بشكل كبير دون المساس بجودة المخرجات.
- تجمع طريقة DSpark بين عمود فقري متوازٍ ورأس تسلسلي خفيف الوزن ومُحقّق مجدول بالثقة لتقليل زمن الانتظار من خلال مقايضة ذاكرة ضئيلة مقابل مكاسب كبيرة في الإنتاجية.
- تُظهر النتائج المعيارية تحسناً في الإنتاجية يصل إلى 3.18x على وحدات معالجة الرسومات NVIDIA H100، ووصولاً إلى 2.87x على الأجهزة الطرفية مثل MacBook Pro M4 Max.
- بالنسبة لأعباء العمل الوكيلية التي تتضمن استدعاء الوظائف، تقلل DSpark زمن الانتظار بنسبة متوسطة تبلغ 57% على مجموعة البيانات BFCL.
- تم فتح مصادر النماذج المسودة في المستودع الرئيسي لـ llama.cpp وSGLang، مع توفر نقاط الفحص على Hugging Face بصيغتي Safetensors وGGUF.
تهدف هذه الإصدار إلى جعل LFM2.5 قابلاً للتطبيق في التطبيقات الوكيلية على الجهاز من خلال توفير دعم فوري للاستدلال الفعال على الحافة وتقديم خدمات GPU عالية الإنتاجية.