أصدر مشروع llama.cpp الإصدار b10989، الذي يقدم دعمًا لتمكين عمليات AllReduce داخل الخلفية (backend) الخاصة بـ ROCm. يُعد هذا التحديث جزءًا من التطوير المستمر لتوسيع توافق الأجهزة وقدرات الحوسبة الموزعة لاستدلال نماذج اللغة الكبيرة.

  • يتضمن الإصدار ثنائيات جاهزة للبناء لأنظمة macOS (شريحة Apple Silicon وIntel)، وLinux (Ubuntu x64، arm64، s390x)، وWindows، وAndroid.
  • تم توسيع خيارات تسريع وحدات معالجة الرسومات لتشمل CUDA 12.8/13.3، وVulkan، وOpenVINO، وSYCL FP32/FP16، وROCm 10.0 عبر المنصات المدعومة.
  • تم توفير تجميعات محددة لعمليتي openEuler x86 وaarch64، بما في ذلك دعم ACL Graph على معالجات 910b.
  • يتوفر أيضًا ثنائي واجهة مستخدم مستقل إلى جانب إصدارات المكتبة الأساسية.

يتيح هذا الإصدار للمستخدمين الاستفادة من وحدات معالجة الرسومات AMD القائمة على ROCm مع وظيفة AllReduce، بينما يوفر ثنائيات محدثة لأنظمة تشغيل متعددة ومسرعات الأجهزة.