El proyecto llama.cpp lanzó la compilación b10509, que introduce soporte para la función `ggml_rope_set_offset` en múltiples backends de hardware. Esta actualización incluye implementaciones de CPU, Metal, CUDA y Vulkan para la nueva operación.
- Se añadieron los parámetros `ggml_rope_set_offset` y la implementación del kernel de CPU.
- Se implementó el soporte del kernel de Metal para la nueva funcionalidad de desplazamiento rope.
- Se habilitó el soporte de CUDA para `ggml_rope_set_offset` mientras se eliminaba la protección `supports_op`.
- Se añadió soporte para el backend de Vulkan en `ggml_rope_set_offset` tanto en Linux como en Windows.
- Se eliminó la optimización in-place de las operaciones relevantes.
El lanzamiento proporciona binarios precompilados para macOS, iOS, Linux, Android, Windows y openEuler en varias arquitecturas, incluyendo CPU, GPU y aceleradores especializados como OpenVINO y SYCL.