Le projet llama.cpp a publié la version b10734, qui inclut une mise à jour pour activer l'API tensor Metal 4.0 pour les appareils équipés de puces M5+ ou A19+.
- Demande la version du langage Metal 4.0 pour l'API tensor.
- Charge les noyaux de l'API tensor depuis une metallib séparée.
- Corrige l'ordre de compilation de la metallib pour les noyaux de l'API tensor.
- Ajoute un test de régression de l'API tensor avec external-metallib.
Cette version fournit des binaires pour macOS, iOS, Linux, Windows, Android et openEuler via divers backends matériels incluant CPU, CUDA, ROCm, Vulkan, OpenVINO, SYCL et OpenCL.