O projeto llama.cpp lançou a compilação b10509, que introduz suporte para a função `ggml_rope_set_offset` em vários backends de hardware. Esta atualização inclui implementações de CPU, Metal, CUDA e Vulkan para a nova operação.

  • Adicionados parâmetros `ggml_rope_set_offset` e implementação do kernel de CPU.
  • Implementado suporte ao kernel de Metal para a nova funcionalidade de deslocamento rope.
  • Ativado o suporte a CUDA para `ggml_rope_set_offset` enquanto removia a proteção `supports_op`.
  • Adicionado suporte ao backend Vulkan para `ggml_rope_set_offset` tanto no Linux quanto no Windows.
  • Removida a otimização in-place das operações relevantes.

O lançamento fornece binários pré-compilados para macOS, iOS, Linux, Android, Windows e openEuler em várias arquiteturas, incluindo CPU, GPU e aceleradores especializados como OpenVINO e SYCL.