أصدر مشروع llama.cpp الإصدار 0.1.2، والذي يتضمن مزامنة مع ggml (تمت ترقيته إلى 0.20.2) وتحديثات متعددة لمكونات الخادم وواجهة المستخدم.

  • CUDA: MMVQ nwarps=8 لـ bs=1 للنماذج الكثيفة على DGX Spark.
  • mtmd: استخدام sha256 لتجزئة الإدخال.
  • vocab: دعم درجات المُوَازِن الصحيحة.
  • mtmd: تخطي الصور المصغرة لصور LFM2 غير المبلمرة.
  • server: حفظ أجزاء mtmd المعالجة كعنصر نائب.
  • ui: فرض ترتيب أعضاء التعداد أبجديًا وإعادة هيكلة تسمية الأدوات المدمجة.

يتضمن هذا الإصدار أيضًا تنظيفات البناء لـ xcframework + cmake وتحديث عمليات CI لتوليد الإصدارات الأولية.