El proyecto llama.cpp lanzó la compilación b10311, que incluye una corrección para la tubería Qwen3-TTS. La actualización resuelve un problema donde el modelo leía dos veces la enunciación de entrada durante la generación.
- Corrige un error en la superposición de prellenado no en streaming que causaba que el flujo de texto se alimentara nuevamente durante la generación de Qwen3-TTS.
- Corrige el estado oculto del texto final para colapsar a una sola fila tts_pad, coincidiendo con el diseño del prellenado.
- Proporciona binarios para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL) y openEuler.