llama.cpp परियोजना ने बिल्ड b11060 जारी किया, जिसमें Mamba मॉडल के लिए एक सुधार शामिल है ताकि समय-चरण प्रक्षेपण इनपुट सतत हो। यह बदलाव Mamba कार्यान्वयन के भीतर मेमोरी लेआउट समस्याओं को दूर करता है।

  • Mamba मॉड्यूल अब त्रुटियों से बचने के लिए समय-चरण प्रक्षेपण इनपुट को सतत बनाता है।
  • Mamba पथ में सामान्यीकरण के बाद एक अगला अनुकूलन सतत कॉपी ऑपरेशन को छोड़ देता है।
  • रिलीज में macOS (Apple Silicon और Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android, और openEuler के लिए बाइनरी फ़ाइलें प्रदान की गई हैं।

यह अपडेट Mamba-आधारित मॉडलों के लिए स्थिरता सुनिश्चित करता है, जबकि llama.cpp इकोसिस्टम में व्यापक हार्डवेयर समर्थन बनाए रखता है।