أصدر مشروع llama.cpp الإصدار b10984، مقدماً دعم CUDA لعمليات SUM_ROWS المتصلة صفياً. ينظم هذا التحديث أيضاً الكود ليشمل GGML_OP_MEAN لمعالجة الموترات المتصلة صفياً عبر نواة مشتركة.

  • تمت إضافة دعم CUDA لـ SUM_ROWS المتصل صفياً.
  • تم تنظيم الكود لإضافة GGML_OP_MEAN للموترات المتصلة صفياً باستخدام نواة مشتركة.
  • تم تضمين اختبارات لعمليات تبديل وقطع MEAN.
  • تم توفير ملفات ثنائية لأنظمة macOS وLinux وWindows وAndroid وopenEuler عبر خلفيات CPU وCUDA وVulkan وROCm وOpenVINO وSYCL.

يضمن الإصدار التوافق مع مسرعات الأجهزة المختلفة وأنظمة التشغيل للاستدلال المحلي.