أصدر مشروع llama.cpp الإصدار b11238، مقدّماً تنفيذًا موحدًا للحشو الأيسر عبر الدالة الجديدة `ggml_pad_ext`. يجمع هذا التغيير الأساليب السابقة المستخدمة في مشفرات الصوت مثل Parakeet وLFM2-Audio وGranite Speech وGemma 4، مما يضمن تطابق التضمينات بتًا ببت لـ Gemma 4 مع تبسيط دعم الخلفية.
- تتعامل عقدة `ggml_pad_ext` الآن مع الحشو الأيسر في عملية واحدة نظرًا لدعم جميع الخلفيات لها، مستبدلةً منطق ربط roll أو ملء الصفوف بالصفر المعقّد.
- يتضمن التحديث تحسينًا لتخطي نقرات DFlash2 التي تقرأ بيانات الحشو فقط، لأن الحدود عند أو بعد block_size تساوي صفرًا.
- تتوفر ثنائيات جاهزة لـ macOS (Apple Silicon وIntel) وiOS وLinux (CPU وVulkan وCUDA 12/13 وROCm وOpenVINO وSYCL وSnapdragon) وAndroid وWindows وopenEuler.
يحسّن هذا الإصدار الاتساق عبر معماريات النماذج المختلفة من خلال توحيد عمليات الحشو، ويقدّم ثنائيات محدّثة لمجموعة واسعة من منصات الأجهزة.