llama.cpp プロジェクトはバージョン b10951 をリリースし、デコードロジックのコード最適化が含まれています。`llama_n_rs_seq` 関数呼び出しは now `llama_decode` の前に実行され、チェックが成功した場合にシステムが直接戻ることを可能にします。
- この変更により、早期リターン条件が満たされたときに `res` 変数を設定し、goto ステートメントを使用する必要がなくなります。
- 主な動機は、必要がない場合に `llama_decode` を呼び出さないようにし、効率を向上させることです。
- バイナリは macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、CUDA 12/13、Vulkan、OpenVINO、SYCL、ROCm)、openEuler で利用可能です。