أصدر مشروع llama.cpp الإصدار b10900، والذي يتضمن تحديثًا تقنيًا لخلفية Vulkan. تضيف هذه النسخة اعتماد تخصيص مخصص لتمكين تحسين دمج topk_moe أثناء مرحلة prefill.

  • التغيير الأساسي في الكود هو إضافة اعتماد تخصيص في تنفيذ Vulkan لدعم دمج topk_moe لعمليات prefill.
  • يتم توفير الملفات الثنائية لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm 10.0، OpenVINO، SYCL)، و Windows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm 10.0)، و Android، و iOS.
  • دعم KleidiAI لأنظمة macOS Apple Silicon معطل في هذا البناء.

يوفر هذا التحديث للمستخدمين أداء prefill محسّنًا على الأجهزة المتوافقة مع Vulkan من خلال تقنية الدمج الجديدة المفعّلة.