أطلق مشروع llama.cpp الإصدار 0.2.0، الذي يتضمن مزامنة مع مكتبة ggml التي ارتفعت إلى الإصدار 0.21.0. يقدم هذا التحديث تحسينات متعددة في الخلفيات وميزات جديدة عبر منصات عتاد مختلفة.
- تمت إضافة دعم نواة Kleidiai SME2 F32 GEMV لتعزيز الأداء على العتاد المتوافق.
- تم تفعيل وظيفة تقسيم الموتر لنماذج LFM2 وLFM2MOE لتحسين توزيعها عبر وحدات معالجة الرسومات المتعددة.
- تم تنفيذ دعم DSpark لنماذج LFM2 ضمن خط أنابيب تحميل النماذج.
- تم تحديث الخلفية SYCL بإعادة ترتيب Q2_K لـ MMVQ، ونوى ESIMD، وإصلاحات لوحات Alchemist GPUs ومشاكل mlock.
- تم تحسين استقرار OpenCL بإصلاحات لمترجمي Adreno A6x/A7x وحسابات الحجم المحلي.
- تمت إضافة الحجة --mmproj-device إلى mtmd لتحديد موقع الأجهزة لتصورات متعددة الوسائط.
يشمل الإصدار أيضاً تنظيفات في CI، وتحسينات في التنقل بإعدادات واجهة المستخدم، وإصلاحات متنوعة للخلفيات CUDA وMetal وVulkan.