Proyek llama.cpp merilis build b10886, yang memperkenalkan dukungan intrinsik vektor Q1_0 untuk arsitektur s390x. Pembaruan ini mencakup implementasi `ggml_vec_dot_q1_0_q8_0` dan memperbarui dokumentasi untuk mencerminkan kemampuan baru.

  • ggml-cpu menambahkan dukungan `ggml_vec_dot_q1_0_q8_0` untuk s390x.
  • Penamaan variabel di ggml-cpu dibersihkan untuk keterbacaan yang lebih baik.
  • Dokumentasi diperbarui untuk menyertakan dukungan kuantisasi Q1_0.

Rilis ini menyediakan biner untuk macOS, Linux (termasuk Ubuntu x64, arm64, dan s390x), Android, Windows, dan openEuler di berbagai backend perangkat keras seperti CPU, Vulkan, ROCm, OpenVINO, SYCL, dan CUDA.