Proyek llama.cpp merilis build b10760, yang mencakup perbaikan spesifik untuk model Qwen3-tts-0.6B guna mencegah ketidakstabilan numerik selama inferensi.
- Pemuat mtmd sekarang memperlakukan proj_in prediktor kode qwen3-tts sebagai opsional, sejalan dengan implementasi referensi di mana tensor ini dihilangkan.
- Lapisan ffn_down prediktor kode dipertahankan dalam presisi F32 karena aktivasi puncaknya sekitar 1.5e5, melebihi batas F16 dan menyebabkan kesalahan NaN.
Perubahan ini memastikan bahwa grafik menangani bobot yang hilang dengan benar dan mencegah overflow pada lapisan beraktivasi tinggi untuk checkpoint spesifik ini.