أصدر مشروع llama.cpp الإصدار b11132، مقدمًا دعمًا للعمود الفقري لمسودة Gemma 4 DSpark. يتيح هذا التحديث تحويل GGUF وقدرات وقت التشغيل لمسودات Gemma 4 ذات الانتباه الكامل وSWA، بما في ذلك أوزان المخرجات المرتبطة وبيانات العمود الفقري المنطقية.

  • تمت إضافة دعم dspark لنماذج مسودة Gemma 4 مع متغيرات الانتباه الكامل وSWA.
  • تم تنفيذ استنتاج ميزات مسودة Gemma من البيانات الوصفية عبر آلية dflash.
  • تم إصدار ملفات ثنائية لأنظمة macOS (Apple Silicon وIntel)، وLinux (CPU، Vulkan، CUDA، ROCm، OpenVINO، SYCL، Snapdragon)، وWindows (CPU، OpenCL، CUDA، Vulkan، OpenVINO، SYCL، ROCm)، وAndroid، وiOS.

يتيح هذا الإصدار للمستخدمين استخدام نماذج Gemma 4 ضمن نظام llama.cpp البيئي على مجموعة واسعة من المنصات الأجهزة.