Prism-ML ने Ternary-Bonsai-27B मॉडल जारी किया है, जो Hugging Face पर GGUF चेकपॉइंट के रूप में उपलब्ध है।
यह रिलीज़ स्थानीय इनफरेंस के लिए GGUF फॉर्मेट के माध्यम से अनुकूलित Qwen 3.6 आर्किटेक्चर का 27 अरब पैरामीटर वाला संस्करण प्रदान करती है।
Prism-ML ने Ternary-Bonsai-27B मॉडल जारी किया है, जो Hugging Face पर GGUF चेकपॉइंट के रूप में उपलब्ध है।
यह रिलीज़ स्थानीय इनफरेंस के लिए GGUF फॉर्मेट के माध्यम से अनुकूलित Qwen 3.6 आर्किटेक्चर का 27 अरब पैरामीटर वाला संस्करण प्रदान करती है।
llama.cpp b10677 रिलीज ने Vulkan बैकएंड में एक गंभीर बग को संबोधित किया, जहाँ अनुपस्थित view-alias निर्भरताओं के कारण ग्राफ ऑप्टिमाइज़र नोड्स को गलत तरीके से पुनः क्रमित कर रहा था।
llama.cpp बिल्ड b10676 ने `conv_transpose_2d` में एक बग को ठीक किया जहाँ केवल पहला बैच गणना किया गया था, और बाद के बैच शून्य रह गए। यह सुधार ggml लाइब्रेरी और Metal बैकएंड दोनों पर लागू होता है।
llama.cpp प्रोजेक्ट ने बिल्ड b10673 जारी किया, जिसमें Apple M4 हार्डवेयर के लिए विशिष्ट प्रदर्शन अनुकूलन शामिल हैं। यह अपडेट ggml-metal-tuning मॉड्यूल में fa_vec_tuned_table रिकॉर्ड्स को पेश करता है ताकि Metal बैकएंड की दक्षता बढ़ाई जा सके।
llama.cpp प्रोजेक्ट ने संस्करण b10670 जारी किया, जिसमें Intel के Xe2 आर्किटेक्चर के लिए एक विशिष्ट अनुकूलन शामिल है। अपडेट क्वांटाइज्ड की-वैल्यू (KV) डिकोड ऑपरेशन को BMG हार्डवेयर के लिए विशेष रूप से TILE बैकएंड की ओर रूट करता है, जबकि अन्य आर्किटेक्चर पर VEC बैकएंड को मान्य होने तक बनाए रखता है।
llama.cpp प्रोजेक्ट ने बिल्ड b10672 जारी किया है, जिसने OpenVINO बैकएंड को संस्करण 2026.3.1 पर अपडेट किया और NPU पर Whisper.cpp मॉडल्स के लिए समर्थन जोड़ा।
हम ट्रैफ़िक मापने और साइट को बेहतर बनाने के लिए कुकीज़ का उपयोग करते हैं। आप एनालिटिक्स कुकीज़ स्वीकार या अस्वीकार कर सकते हैं। गोपनीयता नीति