أطلق مشروع llama.cpp الإصدار 0.2.0، الذي يتضمن مزامنة مع مكتبة ggml التي ارتفعت إلى الإصدار 0.21.0. يقدم هذا التحديث تحسينات متعددة في الخلفيات وميزات جديدة عبر منصات عتاد مختلفة.

  • تمت إضافة دعم نواة Kleidiai SME2 F32 GEMV لتعزيز الأداء على العتاد المتوافق.
  • تم تفعيل وظيفة تقسيم الموتر لنماذج LFM2 وLFM2MOE لتحسين توزيعها عبر وحدات معالجة الرسومات المتعددة.
  • تم تنفيذ دعم DSpark لنماذج LFM2 ضمن خط أنابيب تحميل النماذج.
  • تم تحديث الخلفية SYCL بإعادة ترتيب Q2_K لـ MMVQ، ونوى ESIMD، وإصلاحات لوحات Alchemist GPUs ومشاكل mlock.
  • تم تحسين استقرار OpenCL بإصلاحات لمترجمي Adreno A6x/A7x وحسابات الحجم المحلي.
  • تمت إضافة الحجة --mmproj-device إلى mtmd لتحديد موقع الأجهزة لتصورات متعددة الوسائط.

يشمل الإصدار أيضاً تنظيفات في CI، وتحسينات في التنقل بإعدادات واجهة المستخدم، وإصلاحات متنوعة للخلفيات CUDA وMetal وVulkan.