أصدر مشروع llama.cpp الإصدار b10984، مقدماً دعم CUDA لعمليات SUM_ROWS المتصلة صفياً. ينظم هذا التحديث أيضاً الكود ليشمل GGML_OP_MEAN لمعالجة الموترات المتصلة صفياً عبر نواة مشتركة.
- تمت إضافة دعم CUDA لـ SUM_ROWS المتصل صفياً.
- تم تنظيم الكود لإضافة GGML_OP_MEAN للموترات المتصلة صفياً باستخدام نواة مشتركة.
- تم تضمين اختبارات لعمليات تبديل وقطع MEAN.
- تم توفير ملفات ثنائية لأنظمة macOS وLinux وWindows وAndroid وopenEuler عبر خلفيات CPU وCUDA وVulkan وROCm وOpenVINO وSYCL.
يضمن الإصدار التوافق مع مسرعات الأجهزة المختلفة وأنظمة التشغيل للاستدلال المحلي.