أصدر مشروع llama.cpp الإصدار b10900، والذي يتضمن تحديثًا تقنيًا لخلفية Vulkan. تضيف هذه النسخة اعتماد تخصيص مخصص لتمكين تحسين دمج topk_moe أثناء مرحلة prefill.
- التغيير الأساسي في الكود هو إضافة اعتماد تخصيص في تنفيذ Vulkan لدعم دمج topk_moe لعمليات prefill.
- يتم توفير الملفات الثنائية لأنظمة macOS (Apple Silicon و Intel)، و Linux (CPU، Vulkan، ROCm 10.0، OpenVINO، SYCL)، و Windows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm 10.0)، و Android، و iOS.
- دعم KleidiAI لأنظمة macOS Apple Silicon معطل في هذا البناء.
يوفر هذا التحديث للمستخدمين أداء prefill محسّنًا على الأجهزة المتوافقة مع Vulkan من خلال تقنية الدمج الجديدة المفعّلة.