llama.cpp परियोजना ने संस्करण 0.1.2 जारी किया है, जिसमें ggml के साथ सिंक (0.20.2 तक बढ़ाया गया) और सर्वर व UI घटकों में कई अपडेट शामिल हैं।

  • CUDA: DGX Spark पर घन मॉडलों के लिए bs=1 के लिए MMVQ nwarps=8।
  • mtmd: इनपुट हैशिंग के लिए sha256 का उपयोग करें।
  • vocab: पूर्णांक टोकनाइज़र स्कोर का समर्थन।
  • mtmd: गैर-टाइल्ड LFM2 छवियों के लिए थंबनेल को छोड़ें।
  • server: प्रोसेस्ड mtmd चंक्स को प्लेसहोल्डर के रूप में सहेजें।
  • ui: एन्यूमेरेटर सदस्यों का वर्णमाला क्रम लागू करें और बिल्ट-इन टूल्स नामकरण को पुनर्गठित करें।

इस रिलीज़ में xcframework + cmake के लिए बिल्ड क्लीनअप और प्री-रिलीज़ जनरेशन के लिए CI प्रक्रियाओं में भी अपडेट शामिल हैं।