llama.cpp b10081 रिलीज़ एक बग को ठीक करती है जहां `--hfd` फ्लैग एक ऐसे रिपॉजिटरी की ओर इशारा करता था जिसमें स्पेकुलेटिव साइडकार थे, लेकिन ड्राफ्ट प्लान गलत तरीके से मुख्य मॉडल के बजाय साइडकार में हल हो गया। यह इसलिए हुआ क्योंकि `find_best_model()` ने साइडकार फ़ाइलों को बाहर रखा और स्पष्ट ड्राफ्ट प्लान ने साइडकार खोज को दबा दिया।

सुधार खोजे गए साइडकार को ड्राफ्ट के रूप में जोड़ता है, मुख्य प्लान के फॉलबैक पैटर्न का अनुसरण करते हुए, जिससे `llama-server -hf repo -hfd repo --spec-type draft-dflash` जैसे कमांड अपेक्षित तरीके से काम करते हैं।

इस रिलीज़ में macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP) और openEuler के लिए बाइनरी शामिल हैं।