Проект llama.cpp выпустил сборку b10886, которая внедряет поддержку векторных встроенных функций Q1_0 для архитектуры s390x. Это обновление включает реализацию `ggml_vec_dot_q1_0_q8_0` и обновляет документацию, чтобы отразить новую возможность.

  • ggml-cpu добавляет поддержку `ggml_vec_dot_q1_0_q8_0` для s390x.
  • Именование переменных в ggml-cpu было очищено для лучшей читаемости.
  • Документация была обновлена, чтобы включить поддержку квантования Q1_0.

Этот релиз предоставляет бинарные файлы для macOS, Linux (включая Ubuntu x64, arm64 и s390x), Android, Windows и openEuler на различных аппаратных бэкендах, таких как CPU, Vulkan, ROCm, OpenVINO, SYCL и CUDA.