llama.cpp प्रोजेक्ट ने संस्करण b10539 जारी किया है, जो Vulkan बैकएंड में एक महत्वपूर्ण संख्यात्मक स्थिरता समस्या को संबोधित करता है और विंडोज़ उपयोगकर्ताओं के लिए हार्डवेयर समर्थन का विस्तार करता है।

  • Vulkan FA MMQ अब fp32 का उपयोग Q क्वांटीकरण गणनाओं के लिए करता है ताकि जब qd एक denorm हो तो ओवरफ़्लो से बचा जा सके।
  • CUDA 13 के लिए विंडोज़ x64 बाइनरी और CUDA 13.4 के साथ विंडोज़ arm64 के लिए प्रीव्यू समर्थन जोड़ा गया है।
  • Ubuntu s390x (CPU), macOS Intel (x64), और iOS XCFramework के लिए बिल्ड शामिल हैं।
  • OpenCL Adreno समर्थन अब विंडोज़ arm64 के लिए उपलब्ध है।

यह अपडेट अंकगणितीय त्रुटियों को रोककर Vulkan डिवाइसों पर विश्वसनीय प्रदर्शन सुनिश्चित करता है और उपयोगकर्ताओं को CUDA 13 संगतता के नवीनतम विकल्प प्रदान करता है।