Proyek llama.cpp merilis build b10509, yang memperkenalkan dukungan untuk fungsi `ggml_rope_set_offset` di berbagai backend perangkat keras. Pembaruan ini mencakup implementasi CPU, Metal, CUDA, dan Vulkan untuk operasi baru.
- Ditambahkan parameter `ggml_rope_set_offset` dan implementasi kernel CPU.
- Diimplementasikan dukungan kernel Metal untuk fungsionalitas offset rope baru.
- Diaktifkan dukungan CUDA untuk `ggml_rope_set_offset` sambil menghapus guard `supports_op`.
- Ditambahkan dukungan backend Vulkan untuk `ggml_rope_set_offset` di Linux dan Windows.
- Dihapus optimasi inplace dari operasi yang relevan.
Rilis ini menyediakan biner pra-kompilasi untuk macOS, iOS, Linux, Android, Windows, dan openEuler di berbagai arsitektur termasuk CPU, GPU, dan akselerator khusus seperti OpenVINO dan SYCL.