Le projet llama.cpp a publié la version b10734, qui inclut une mise à jour pour activer l'API tensor Metal 4.0 pour les appareils équipés de puces M5+ ou A19+.

  • Demande la version du langage Metal 4.0 pour l'API tensor.
  • Charge les noyaux de l'API tensor depuis une metallib séparée.
  • Corrige l'ordre de compilation de la metallib pour les noyaux de l'API tensor.
  • Ajoute un test de régression de l'API tensor avec external-metallib.

Cette version fournit des binaires pour macOS, iOS, Linux, Windows, Android et openEuler via divers backends matériels incluant CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL et OpenCL.