llama.cpp 프로젝트는 빌드 b11060을 출시했으며, 여기에는 시간 단계 투영 입력이 연속적임을 보장하기 위한 Mamba 모델의 수정 사항이 포함되어 있습니다. 이 변경은 Mamba 구현 내의 메모리 레이아웃 문제를 해결합니다.

  • Mamba 모듈은 오류를 방지하기 위해 시간 단계 투영 입력을 연속적으로 만듭니다.
  • Mamba 경로에서 정규화 후 연속 복사 작업을 건너뛰는 후속 최적화가 적용됩니다.
  • 이번 릴리스에서는 macOS (Apple Silicon 및 Intel), iOS, Linux (CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL), Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android 및 openEuler에 대한 바이너리를 제공합니다.

이 업데이트는 llama.cpp 생태계 전반에 걸친 광범위한 하드웨어 지원을 유지하면서 Mamba 기반 모델의 안정성을 보장합니다.