أصدر مشروع llama.cpp الإصدار b11238، مقدّماً تنفيذًا موحدًا للحشو الأيسر عبر الدالة الجديدة `ggml_pad_ext`. يجمع هذا التغيير الأساليب السابقة المستخدمة في مشفرات الصوت مثل Parakeet وLFM2-Audio وGranite Speech وGemma 4، مما يضمن تطابق التضمينات بتًا ببت لـ Gemma 4 مع تبسيط دعم الخلفية.

  • تتعامل عقدة `ggml_pad_ext` الآن مع الحشو الأيسر في عملية واحدة نظرًا لدعم جميع الخلفيات لها، مستبدلةً منطق ربط roll أو ملء الصفوف بالصفر المعقّد.
  • يتضمن التحديث تحسينًا لتخطي نقرات DFlash2 التي تقرأ بيانات الحشو فقط، لأن الحدود عند أو بعد block_size تساوي صفرًا.
  • تتوفر ثنائيات جاهزة لـ macOS (Apple Silicon وIntel) وiOS وLinux (CPU وVulkan وCUDA 12/13 وROCm وOpenVINO وSYCL وSnapdragon) وAndroid وWindows وopenEuler.

يحسّن هذا الإصدار الاتساق عبر معماريات النماذج المختلفة من خلال توحيد عمليات الحشو، ويقدّم ثنائيات محدّثة لمجموعة واسعة من منصات الأجهزة.