llama.cpp प्रोजेक्ट ने संस्करण b10951 जारी किया, जिसमें डिकोडिंग लॉजिक में कोड अनुकूलन शामिल है। `llama_n_rs_seq` फ़ंक्शन कॉल अब `llama_decode` से पहले निष्पादित होता है, जिससे सिस्टम जाँच पास होने पर सीधे वापस आ सकता है।
- इस बदलाव से जल्दी लौटने की स्थिति पूरी होने पर `res` वेरिएबल सेट करने और goto स्टेटमेंट का उपयोग करने की आवश्यकता खत्म हो जाती है।
- प्राथमिक प्रेरणा तब जब आवश्यक न हो तो `llama_decode` को इन्वोक करने से बचना है, जिससे दक्षता बढ़ती है।
- बाइनरी macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) और openEuler के लिए उपलब्ध हैं।