Proyek llama.cpp merilis versi b11090, yang mencakup perbaikan untuk kesalahan kompilasi tile sm_70. Pembaruan ini menggeneralisasi bentuk tile fungsi load_ldmatrix 5 argumen untuk menyelesaikan ketidakcocokan dengan arsitektur Volta.

  • Memperbaiki kesalahan kompilasi pada sm_70 dengan menggeneralisasi bentuk tile load_ldmatrix dari <16,8> menjadi <I,J>.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, CUDA, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA, Vulkan, OpenCL, OpenVINO, SYCL, ROCm), Android, dan openEuler.

Rilis ini memastikan kompatibilitas dengan arsitektur GPU yang lebih lama sambil mempertahankan dukungan di berbagai sistem operasi dan akselerator perangkat keras.