O projeto llama.cpp lançou a versão b10270, introduzindo suporte para o modelo Qwen3-TTS. Esta atualização inclui uma mudança que quebra no binário llama-tts e implementa modificações arquiteturais significativas para lidar com o novo fluxo de trabalho de texto para fala.
- Adicionado suporte para converter e carregar componentes do Qwen3-TTS, incluindo o modelo principal, codificador, codificador de locutor e code_predictor.
- Introduzida uma nova API mtmd gen e renomeado o componente CODE2WAV para GEN_WAV.
- Implementadas capacidades de clonagem de voz e preservados os estados chave-valor entre chamadas para melhorar a continuidade.
- Adicionadas as APIs llama_model_get_tok_embd e mtmd_helper_gen_audio para interação aprimorada com o modelo.
- Incluídas correções de segurança, atualizações de documentação e suporte para vários backends de hardware em macOS, Linux, Windows e Android.