أصدر مشروع llama.cpp الإصدار b11203، والذي يتضمن تغييرًا في تحويل Fast Walsh-Hadamard (FWHT) الخاص بـ CUDA لقبول مدخلات F16. سابقًا، كان FWHT الخاص بـ CUDA يقبل فقط مدخلات F32؛ يجعل هذا التحديث نوع المصدر معلمة قالب بحيث يقرأ النواة مصدر F16 مباشرة دون الحاجة إلى نسخة محولة.
تضمن التنفيذ أن `supports_op` واستدعاء التوجيه يتشاركان تنبؤًا واحدًا يتحقق من شروط الاستمرارية والشكل، مما يغلق فجوة حيث يمكن أن تسبب عدم التطابقات فشلAssertions. اجتاز Test-backend-ops على GPU A10 جميع اختبارات MUL_MAT البالغ عددها 1297، بما في ذلك 6 حالات Hadamard F16 جديدة alongside الحالات الموجودة F32.
يوفر هذا الإصدار ملفات ثنائية لـ macOS و Linux و Windows و Android و openEuler عبر backends CPU و CUDA و ROCm و Vulkan و OpenVINO و SYCL و Snapdragon.