أطلقت Liquid AI نقاط تفتيش لنماذج المسودة DSpark لثلاثة نماذج من عائلة LFM2.5: LFM2.5-1.2B-Instruct، وLFM2.5-2.6B، وLFM2.5-8B-A1B. تضيف هذه الموديلات المسودة مسار فك تشفير تخميني إلى النماذج المستهدفة الحالية، مما يتيح لموديل مسودة بحجم 300 مليون معامل تقريباً اقتراح كتلة من تسعة رموز مرشحة يتحقق منها النموذج المستهدف في تمرير أمامي واحد.
- يقدم النظام تسريعاً في فك التشفير يصل إلى 3.18x على H100 و2.87x على MacBook Pro بمعالج M4 Max دون تغيير مخرجات النموذج.
- تحت فك التشفير الجشع، يكون التسلسل المُصدر مطابقاً تماماً للنموذج المستهدف يعمل بمفرده، مما يضمن بقاء دقة المعايير كما هي.
- يجمع DSpark بين عمود فقري متوازي على طراز DFlash ورأس تسلسلي خفيف الوزن مُصمم كسلسلة ماركوف ومُتحقق بجداول ثقة.
- في سيناريوهات استدعاء الوظائف المتعددة الأدوات، انخفضت زمن الاستجابة بنسبة 57% في المتوسط لـ LFM2.5-2.6B، رغم أن نماذج MoE تحقق تسريعاً بنسبة 1.18x فقط على شرائح Apple silicon بسبب قيود التنفيذ الحالية.
- الأوزان متوفرة بصيغتي Safetensors وGGUF، مع دعم فوري في llama.cpp وSGLang.
تتيح هذه التقنية للمطورين تقليل زمن الاستدلال بشكل كبير لمساعدات البرمجة المحلية والوكلاء على الجهاز والنماذج المساعدة غير المتصلة بالإنترنت، مع الحفاظ على خصوصية البيانات من خلال الاستضافة الذاتية.