llama.cpp परियोजना ने बिल्ड b10150 जारी किया है, जिसमें वजन के बैकएंड पर ऑपरेशन ऑफलोड करने के लिए ggml तर्क में समायोजन शामिल हैं। यह अपडेट llama dsv4 ग्राफ़ के लिए ठीक करने की समस्याओं को भी हल करता है।

  • ggml: वजन के बैकएंड पर ops को ऑफलोड करने के लिए तर्क समायोजित करें
  • llama: dsv4 ग्राफ़ ठीक करें

इस रिलीज़ में CPU, CUDA, Vulkan, ROCm और OpenVINO सहित विभिन्न हार्डवेयर बैकएंड्स के लिए macOS, Linux, Windows, Android और iOS के लिए अपडेटेड बाइनरी प्रदान की गई हैं।