llama.cpp プロジェクトはバージョン b10418 をリリースし、SYCL のホストからデバイスへのメモリアクセスを改善するためにホストピンドメモリのサポートを導入しました。このアップデートはバックエンド実装内のスレッドセーフティの問題に対処します。
- ホストピンドメモリ用の ggml_backend_sycl_host_buffer_type_get_max_size サポートを追加。
- SYCL バックエンドのスレッドセーフな問題を修正。
- macOS (Apple Silicon および Intel)、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL FP32/FP16)、Android、Windows (CPU、OpenCL、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm 7.14)、openEuler 用のバイナリを含む。
- すべてのプラットフォーム向けの統一された UI パッケージを提供。
このリリースにより、SYCL 対応ハードウェアでホストとデバイスメモリの間のデータ転送が高速化され、スレッドセーフティの改善により安定性が確保されます。