يقدم llama.cpp 0.3.0 دعمًا لنموذج dots3-note متعدد الوسائط مع نوع جديد من ذاكرة التخزين المؤقت KV هو DSA-ISWA، بالإضافة إلى دعم التنبؤ بعدة رموز (MTP) لـ GLM-4.5-Air. يتضمن الإصدار أيضًا قدرات تقسيم الأوزان لـ DeepSeek 4 ويصحح مشكلات التراجع متعدد التسلسلات.
- تم رفع إصدار ggml إلى v0.22.0، مما يضيف دعمًا لتقسيم الأوزان إلى الخلفية الوصفية ونوى Metal الخاصة بكل عملية مع الترجمة المتوازية.
- يكتسب mtmd دعم الرؤية/الصوت لنموذج dots3-note، وفك تشفير WebP عبر ffmpeg، وخوارزمية تغيير الحجم بدقة مطابقة لـ Pillow.
- يتلقى DeepSeek 4 وضع تقسيم الأوزان عبر العلم `-sm tensor` ويصحح مشكلات التراجع مع التسلسلات المتعددة.
- يضيف الخادم مقبض تصحيح أخطاء `LLAMA_SERVER_SLOTS_N_DIFF`، بينما تكتسب واجهة المستخدم عبر الويب تنقلًا للدردشة بنظام التبويبات.
يوسع هذا التحديث القدرات متعددة الوسائط لـ llama.cpp ويحسن الأداء والاستقرار لمعماريات نماذج محددة مثل DeepSeek 4 وGLM-4.5-Air.