Le projet llama.cpp a publié la construction b10886, qui introduit le support des intrinsèques vectoriels Q1_0 pour l'architecture s390x. Cette mise à jour inclut l'implémentation de `ggml_vec_dot_q1_0_q8_0` et met à jour la documentation pour refléter la nouvelle capacité.
- ggml-cpu ajoute le support de `ggml_vec_dot_q1_0_q8_0` pour s390x.
- La nomenclature des variables dans ggml-cpu a été nettoyée pour une meilleure lisibilité.
- La documentation a été mise à jour pour inclure le support de la quantification Q1_0.
Cette version fournit des binaires pour macOS, Linux (y compris Ubuntu x64, arm64 et s390x), Android, Windows et openEuler sur divers backends matériels tels que CPU, Vulkan, ROCm, OpenVINO, SYCL et CUDA.