أصدر مشروع llama.cpp الإصدار 0.1.2، والذي يتضمن مزامنة مع ggml (تمت ترقيته إلى 0.20.2) وتحديثات متعددة لمكونات الخادم وواجهة المستخدم.
- CUDA: MMVQ nwarps=8 لـ bs=1 للنماذج الكثيفة على DGX Spark.
- mtmd: استخدام sha256 لتجزئة الإدخال.
- vocab: دعم درجات المُوَازِن الصحيحة.
- mtmd: تخطي الصور المصغرة لصور LFM2 غير المبلمرة.
- server: حفظ أجزاء mtmd المعالجة كعنصر نائب.
- ui: فرض ترتيب أعضاء التعداد أبجديًا وإعادة هيكلة تسمية الأدوات المدمجة.
يتضمن هذا الإصدار أيضًا تنظيفات البناء لـ xcframework + cmake وتحديث عمليات CI لتوليد الإصدارات الأولية.