llama.cpp 프로젝트는 CUDA 백엔드에 특정 업데이트를 도입한 버전 b11205을 출시했습니다. 이 릴리스는 SSM 스캔 구현 내에서 Nemotron 3 퍼즐 상태 크기 96에 대한 지원을 추가합니다.

  • 업데이트는 CUDA 하드웨어에서 퍼즐 상태 크기가 96인 Nemotron 3 모델을 처리할 수 있게 합니다.
  • macOS(Apple Silicon 및 Intel), Linux(CPU, Vulkan, CUDA, ROCm, OpenVINO, SYCL, Snapdragon), Windows(CPU, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android 및 iOS용 바이너리가 제공됩니다.
  • 릴리스에는 플랫폼별 실행 파일과 함께 표준 UI 바이너리가 포함되어 있습니다.

이 업데이트를 사용하면 llama.cpp를 사용하여 호환되는 NVIDIA GPU에서 특정 상태 크기의 Nemotron 3 모델을 실행할 수 있습니다.