أصدر مشروع llama.cpp الإصدار b11282، الذي يتضمن إصلاحًا لتعريف ماكرو `CUDA_ARCH` لمرور جهاز MUSA. سابقًا، لم يحدد رأس مورد MUSA هذه المتغير، مما تسبب في تقييم اختبارات الهندسة المعمارية في مصادر ggml-cuda المشتركة إلى صفر ونتج عن ذلك أجسام نواة فارغة.
- يبلغ الإصلاح عن أحدث هندسة معمارية مشابهة للخلفية HIP بينما يستبعد بشكل صريح ميزات NVIDIA فقط غير المتوافقة مع MUSA.
- يتم تعريف `CUDA_ARCH` الآن فقط لمرور الجهاز لمواءمة منطق الكشف في CUB وسلوك nvcc.
- تم إزالة الفحوصات الزائدة عن الحاجة `defined(CUDA_ARCH)` في مقارنات الهندسة المعمارية لأن الماكرو غير معرف في مرور المضيف لـ CUDA و MUSA.
يضمن هذا التغيير أن أجسام النواة المقيدة بالهندسة المعمارية، مثل نواة فك التكمية q8_0 -> f16، يتم تجميعها بشكل صحيح لأجهزة MUSA بدلاً من التوسع إلى أجسام فارغة.