llama.cpp प्रोजेक्ट ने संस्करण b10870 जारी किया, जिसमें Intel coopmat1 हार्डवेयर के लिए f16 B-टाइप मैट्रिक्स गुणा पाइपलाइन और warp टाइल साइज़ ट्यूनिंग के लिए Vulkan समर्थन पेश किया गया है।
- Intel coopmat1 के लिए f16 B-टाइप मैट्रिक्स गुणा पाइपलाइन और warp टाइल साइज़ ट्यूनिंग जोड़ी गई।
- सभी वेंडर्स के लिए घनत्वपूर्ण मैट्रिक्स गुणा के लिए f16 B-टाइप पाइपलाइन सक्षम की गई, जबकि Mixture of Experts (MoE) समर्थन को Intel तक सीमित रखा गया।
- अनुपस्थित OCP FP4 शाखाएं जोड़ी गईं और required_subgroup_size को Intel तक प्रतिबंधित किया गया।
- mul_mat_id में mmp चयन को सरल और परिष्कृत किया गया।
इस अपडेट से विशिष्ट मैट्रिक्स संचालनों के लिए Vulkan संगतता का विस्तार हुआ है और हार्डवेयर उपयोग को बेहतर बनाने के लिए आंतरिक चयन तर्क को परिष्कृत किया गया है।