أصدر مشروع llama.cpp الإصدار b10739، والذي يتضمن تحسينًا للأداء مخصصًا لأجهزة Apple M2 Max. يقدم هذا التحديث ضبط متجه الانتباه السريع (fa-vec) المصمم خصيصًا لـ 30 نواة GPU في M2 Max.

  • تمت إضافة صفوف ضبط fa-vec لـ M2 Max تم جمعها باستخدام ggml-metal-tuning على الأنواع f16 و q8_0.
  • تم توفير ملفات ثنائية لأنظمة macOS Apple Silicon و Macs Intel و iOS و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL) و Windows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm) و Android و openEuler.

يضمن هذا الإصدار أداء استنتاج محسّنًا على أحدث شرائح Apple silicon مع الحفاظ على دعم واسع عبر أنظمة التشغيل المختلفة ومسرعات الأجهزة.