Le projet llama.cpp a publié la version b11090, qui inclut une correction pour une erreur de compilation des tuiles sm_70. La mise à jour généralise la forme de la tuile de la fonction load_ldmatrix à 5 arguments afin de résoudre les incompatibilités avec les architectures Volta.

  • Corrige les erreurs de compilation sur sm_70 en généralisant les formes des tuiles load_ldmatrix de <16,8> à <I,J>.
  • Fournit des binaires pour macOS (Apple Silicon et Intel), iOS, Linux (CPU, CUDA, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA, Vulkan, OpenCL, OpenVINO, SYCL, ROCm), Android et openEuler.

Cette version assure la compatibilité avec les architectures GPU plus anciennes tout en maintenant le support sur une large gamme de systèmes d'exploitation et d'accélérateurs matériels.