llama.cpp プロジェクトは、Qwen3-TTS パイプラインの修正を含むビルド b10311 をリリースしました。このアップデートは、モデルが生成中に入力発話を2回読み取る問題を解決します。
- Qwen3-TTS 生成中にテキストストリームが再度フィードされる原因となっていた、非ストリーミングプリフェッチオーバーレイのバグを修正します。
- 末尾のテキストの隠れ状態を単一の tts_pad 行に折りたたみ、プリフェッチレイアウトと一致させます。
- macOS (Apple Silicon および Intel)、iOS、Linux (CPU、Vulkan、ROCm、OpenVINO、SYCL)、Android、Windows (CPU、CUDA 12/13、Vulkan、OpenCL、ROCm、SYCL)、および openEuler 用のバイナリを提供します。