O projeto llama.cpp lançou a compilação b10886, que introduz o suporte a intrínsecos vetoriais Q1_0 para a arquitetura s390x. Esta atualização inclui a implementação de `ggml_vec_dot_q1_0_q8_0` e atualiza a documentação para refletir a nova capacidade.

  • ggml-cpu adiciona suporte a `ggml_vec_dot_q1_0_q8_0` para s390x.
  • A nomenclatura de variáveis no ggml-cpu foi limpa para melhor legibilidade.
  • A documentação foi atualizada para incluir o suporte à quantização Q1_0.

Esta versão fornece binários para macOS, Linux (incluindo Ubuntu x64, arm64 e s390x), Android, Windows e openEuler em vários backends de hardware como CPU, Vulkan, ROCm, OpenVINO, SYCL e CUDA.