Le projet llama.cpp a publié la compilation b10509, qui introduit le support de la fonction `ggml_rope_set_offset` sur plusieurs backends matériels. Cette mise à jour inclut les implémentations CPU, Metal, CUDA et Vulkan pour la nouvelle opération.
- Ajout des paramètres `ggml_rope_set_offset` et de l'implémentation du noyau CPU.
- Mise en place du support du noyau Metal pour la nouvelle fonctionnalité de décalage rope.
- Activation du support CUDA pour `ggml_rope_set_offset` tout en supprimant le garde-fou `supports_op`.
- Ajout du support du backend Vulkan pour `ggml_rope_set_offset` sur Linux et Windows.
- Suppression de l'optimisation in-place des opérations concernées.
La version fournit des binaires précompilés pour macOS, iOS, Linux, Android, Windows et openEuler sur diverses architectures, y compris CPU, GPU et accélérateurs spécialisés comme OpenVINO et SYCL.