Proyek llama.cpp merilis build b10509, yang memperkenalkan dukungan untuk fungsi `ggml_rope_set_offset` di berbagai backend perangkat keras. Pembaruan ini mencakup implementasi CPU, Metal, CUDA, dan Vulkan untuk operasi baru.

  • Ditambahkan parameter `ggml_rope_set_offset` dan implementasi kernel CPU.
  • Diimplementasikan dukungan kernel Metal untuk fungsionalitas offset rope baru.
  • Diaktifkan dukungan CUDA untuk `ggml_rope_set_offset` sambil menghapus guard `supports_op`.
  • Ditambahkan dukungan backend Vulkan untuk `ggml_rope_set_offset` di Linux dan Windows.
  • Dihapus optimasi inplace dari operasi yang relevan.

Rilis ini menyediakan biner pra-kompilasi untuk macOS, iOS, Linux, Android, Windows, dan openEuler di berbagai arsitektur termasuk CPU, GPU, dan akselerator khusus seperti OpenVINO dan SYCL.