llama.cpp प्रोजेक्ट ने संस्करण b10094 जारी किया, जिसमें एक विशेषता शामिल है जो ड्राफ्ट रिपॉजिटरी साइडकार्स से स्वचालित रूप से स्पेकुलेटिव डिकोडिंग टाइप का पता लगाती है। पहले, जब `-hfd` फ्लैग का उपयोग करके किसी रिपॉजिटरी की ओर इशारा किया जाता था जिसमें mtp-, dflash-, या eagle3- साइडकार्स होते हैं और `--spec-type` स्पष्ट रूप से प्रदान नहीं किया जाता है, तो सिस्टम ड्राफ्ट को गलत तरीके से पूर्ण मॉडल के रूप में हल करता था।
इस अपडेट के साथ, यदि कोई स्पेकुलेटिव टाइप निर्दिष्ट नहीं है, तो llama-server ड्राफ्ट रिपॉजिटरी में उपलब्ध साइडकार्स को खोजता है और mtp, dflash, फिर eagle3 की प्राथमिकता क्रम के आधार पर पहला एक चुनता है। इससे उपयोगकर्ताओं को अतिरिक्त फ्लैग के बिना `llama-server -hf repo:Q3_K_M -hfd repo:Q8_0` जैसे कमांड चलाने की अनुमति मिलती है। एक स्पष्ट `--spec-type` तर्क अभी भी इस स्वचालित अनुमान को अक्षम कर देता है।
रिलीज में macOS (Apple Silicon और Intel), iOS, Linux (Ubuntu x64/arm64/s390x with CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL), Android arm64, Windows (CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), और openEuler के लिए बाइनरी शामिल हैं।