أصدر مشروع llama.cpp الإصدار b10715، والذي يتضمن تحسينًا رئيسيًا لتنفيذ DFlash. تم الآن دمج مشفر DFlash مباشرةً في عملية حقن ذاكرة التخزين المؤقت KV أثناء فك التشفير.

في السابق، كان تشغيل المشفر كاستدعاء منفصل `llama_encode` يفرض رحلة ذهاب وإياب من الجهاز إلى المضيف لإخراجها قبل أن يتمكن فك التشفير بالحقن من إعادة تحميله، بالإضافة إلى بناء رسم بياني ثانٍ لكل جولة. يدمج هذا التغيير المشفر في فرع تضمين المفك، مما يسمح بتغذية السمات المستهدفة مباشرةً في استدعاء واحد `llama_decode`.

يوفر الإصدار ملفات ثنائية لنظام macOS (Apple Silicon و Intel)، و iOS، و Linux (CPU، Vulkan، ROCm، OpenVINO، SYCL)، و Android، و Windows (CPU، CUDA 12/13، Vulkan، OpenVINO، SYCL، ROCm)، و openEuler.