Proyek llama.cpp merilis build b10311, yang mencakup perbaikan untuk pipeline Qwen3-TTS. Pembaruan ini menyelesaikan masalah di mana model membaca ucapan input dua kali selama generasi.

  • Memperbaiki bug di overlay praisi non-streaming yang menyebabkan aliran teks diberi makan lagi selama generasi Qwen3-TTS.
  • Memperbaiki keadaan tersembunyi teks akhir agar runtuh menjadi satu baris tts_pad, sesuai dengan tata letak praisi.
  • Menyediakan biner untuk macOS (Apple Silicon dan Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm, SYCL), dan openEuler.