llama.cpp परियोजना ने संस्करण 0.1.2 जारी किया है, जिसमें ggml के साथ सिंक (0.20.2 तक बढ़ाया गया) और सर्वर व UI घटकों में कई अपडेट शामिल हैं।
- CUDA: DGX Spark पर घन मॉडलों के लिए bs=1 के लिए MMVQ nwarps=8।
- mtmd: इनपुट हैशिंग के लिए sha256 का उपयोग करें।
- vocab: पूर्णांक टोकनाइज़र स्कोर का समर्थन।
- mtmd: गैर-टाइल्ड LFM2 छवियों के लिए थंबनेल को छोड़ें।
- server: प्रोसेस्ड mtmd चंक्स को प्लेसहोल्डर के रूप में सहेजें।
- ui: एन्यूमेरेटर सदस्यों का वर्णमाला क्रम लागू करें और बिल्ट-इन टूल्स नामकरण को पुनर्गठित करें।
इस रिलीज़ में xcframework + cmake के लिए बिल्ड क्लीनअप और प्री-रिलीज़ जनरेशन के लिए CI प्रक्रियाओं में भी अपडेट शामिल हैं।