O projeto llama.cpp lançou a compilação b10509, que introduz suporte para a função `ggml_rope_set_offset` em vários backends de hardware. Esta atualização inclui implementações de CPU, Metal, CUDA e Vulkan para a nova operação.
- Adicionados parâmetros `ggml_rope_set_offset` e implementação do kernel de CPU.
- Implementado suporte ao kernel de Metal para a nova funcionalidade de deslocamento rope.
- Ativado o suporte a CUDA para `ggml_rope_set_offset` enquanto removia a proteção `supports_op`.
- Adicionado suporte ao backend Vulkan para `ggml_rope_set_offset` tanto no Linux quanto no Windows.
- Removida a otimização in-place das operações relevantes.
O lançamento fornece binários pré-compilados para macOS, iOS, Linux, Android, Windows e openEuler em várias arquiteturas, incluindo CPU, GPU e aceleradores especializados como OpenVINO e SYCL.