أصدر مشروع llama.cpp الإصدار b10950، مقدماً تحديثاً حاسماً لخلفيته ggml-cuda. يضمن هذا الإصدار التوافق مع الأجهزة التي تفتقر إلى التسريع الأصلي BFloat16 من خلال التراجع إلى دقة FP32.

  • يتراجع الخلفية CUDA الآن إلى F32 على الأجهزة التي لا تحتوي على تسريع عتاد BF16 لـ Nvidia (>= AMPERE) و AMD (>= RDNA3 أو = CDNA).
  • تم توسيع المنطق المطبق سابقاً على البنى الأخرى ليشمل أيضاً وحدات معالجة الرسومات NVIDIA.
  • يتم توفير الملفات الثنائية لأنظمة macOS و Linux و Windows و Android و openEuler عبر خلفيات CPU و CUDA و Vulkan و ROCm و OpenVINO و SYCL.

يتيح هذا التغيير للمستخدمين الذين يمتلكون بنى عتاد رسومات قديمة أو محددة تشغيل النماذج دون مواجهة أخطاء توافق العتاد.