Проект llama.cpp выпустил версию b11205, которая вносит конкретное обновление в свой бэкенд CUDA. Этот релиз добавляет поддержку размера состояния Puzzle 96 для Nemotron 3 в реализации сканирования SSM.
- Обновление позволяет обрабатывать модели Nemotron 3 с размером состояния puzzle 96 на оборудовании CUDA.
- Бинарные файлы предоставляются для macOS (Apple Silicon и Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android и iOS.
- В релиз включены стандартные бинарные файлы UI наряду с исполняемыми файлами для конкретных платформ.
Это обновление позволяет пользователям запускать модели Nemotron 3 с определенными размерами состояний на совместимых графических процессорах NVIDIA с помощью llama.cpp.