Proyek llama.cpp telah merilis versi b11205, yang memperkenalkan pembaruan spesifik pada backend CUDA-nya. Rilis ini menambahkan dukungan untuk ukuran keadaan Puzzle 96 dari Nemotron 3 di dalam implementasi pemindaian SSM.

  • Pembaruan ini memungkinkan penanganan model Nemotron 3 dengan ukuran keadaan puzzle 96 pada perangkat keras CUDA.
  • Binari disediakan untuk macOS (Apple Silicon dan Intel), Linux (CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows (CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android, dan iOS.
  • Rilis ini menyertakan binari UI standar bersama dengan eksekutabel spesifik platform.

Pembaruan ini memungkinkan pengguna menjalankan model Nemotron 3 dengan ukuran keadaan tertentu pada GPU NVIDIA yang kompatibel menggunakan llama.cpp.