أصدر مشروع llama.cpp الإصدار b11205، الذي يقدم تحديثًا محددًا لخلفيته البرمجية CUDA. يضيف هذا الإصدار دعم حجم حالة اللغز 96 لـ Nemotron 3 ضمن تنفيذ مسح SSM.
- يتيح التحديث التعامل مع نماذج Nemotron 3 التي تحتوي على حجم حالة لغز يبلغ 96 على الأجهزة المدعومة بـ CUDA.
- يتم توفير الملفات الثنائية لأنظمة macOS (Apple Silicon وIntel)، وLinux (CPU، Vulkan، CUDA، ROCm، OpenVINO، SYCL، Snapdragon)، وWindows (CPU، CUDA، Vulkan، OpenVINO، SYCL، ROCm)، وAndroid، وiOS.
- يتضمن الإصدار ملفات ثنائية لواجهة المستخدم القياسية إلى جانب الملفات التنفيذية الخاصة بالمنصة.
يتيح هذا التحديث للمستخدمين تشغيل نماذج Nemotron 3 ذات أحجام الحالات المحددة على وحدات معالجة الرسومات NVIDIA المتوافقة باستخدام llama.cpp.