llama.cpp प्रोजेक्ट ने बिल्ड b10273 जारी किया, जिसने एक महत्वपूर्ण मुद्दे को संबोधित किया जहाँ इतिहास-आधारित सैंपलर्स प्रारंभिकरण के दौरान बैकएंड-सैंपलिंग प्रतिबंधों के कारण सही संदर्भ लंबाई का अनुमान नहीं लगा पा रहे थे।

  • प्रारंभिकरण त्रुटियों को ठीक करने के लिए सैंपलर्स के लिए ctx-len के बजाय -1 से 1024 तक हल करता है।
  • इतिहास-आधारित सैंपलर्स के लिए 64 का एक साझा डिफ़ॉल्ट सेट करता है और context_size पैरामीटर को हटा देता है।
  • CPU, GPU (CUDA, Vulkan, ROCm, SYCL), और OpenVINO बैकएंड्स के लिए macOS, Linux, Windows, Android, और openEuler के लिए बाइनरी प्रदान करता है।

यह अपडेट सुनिश्चित करता है कि पूर्ण llama_context अभी तक उपलब्ध न होने के दौरान शुरुआती निर्माण चरणों में स्थिर सैंपलर व्यवहार हो।