llama.cpp プロジェクトはビルド b10509 をリリースし、複数のハードウェアバックエンドで `ggml_rope_set_offset` 関数のサポートを導入しました。このアップデートには、新しい操作の CPU、Metal、CUDA、Vulkan の実装が含まれています。
- `ggml_rope_set_offset` パラメータと CPU カーネル実装を追加。
- 新しい rope オフセット機能に対する Metal カーネルサポートを実装。
- `supports_op` ガードを削除しながら `ggml_rope_set_offset` に対する CUDA サポートを有効化。
- Linux と Windows の両方で `ggml_rope_set_offset` に対する Vulkan バックエンドサポートを追加。
- 関連する操作からインプレース最適化を削除。
リリースでは、CPU、GPU、OpenVINO や SYCL などの専用アクセラレータを含む様々なアーキテクチャ向けに、macOS、iOS、Linux、Android、Windows、openEuler のプリコンパイル済みバイナリが提供されています。