أصدر مشروع llama.cpp الإصدار b10164، مقدمًا تنفيذًا جديدًا لضرب المصفوفات SSD المقطّع مصممًا لتسريع مرحلة التعبئة المسبقة لنماذج Mamba-2.

  • ggml-cuda: إضافة ضرب مصفوفات SSD المقطّع لتسريع التعبئة المسبقة لـ Mamba-2
  • إصلاحات دقة CUDA SSD عن طريق ترقية s0_stride_seq إلى int64_t وتحسين التجميع الذاكري في ssm_ssd_prepare_dt_kernel
  • تجسيد مدمج لمصفوفة M في النواة pre_matmul
  • إصلاح سباق القراءة-الكتابة sdata في حلقة المسح الاحتياطية لـ prepare_dt
  • إضافة إصلاحات CICD لـ SSD لكل من CUDA و HIP و MUSA و MSVC

يوفر هذا التحديث نوى GPU محسّنة للبنى المعمارية المحددة لنماذج الفضاء الحالة مع الحفاظ على توافق واسع عبر الخلفيات CPU و Vulkan و ROCm و OpenVINO و SYCL.