llama.cpp 프로젝트는 Qwen3-TTS 파이프라인에 대한 수정을 포함한 빌드 b10311을 출시했습니다. 이 업데이트는 모델이 생성 중에 입력 발화를 두 번 읽는 문제를 해결합니다.
- Qwen3-TTS 생성 동안 텍스트 스트림이 다시 피드되는 원인이 되었던 비스트리밍 프리필 오버레이의 버그를 수정합니다.
- 트레일링 텍스트 히든 상태를 단일 tts_pad 행으로 축소하여 프리필 레이아웃과 일치하도록 수정합니다.
- macOS (Apple Silicon 및 Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL) 및 openEuler용 바이너리를 제공합니다.