O projeto llama.cpp lançou a compilação b11048, que introduz suporte para as novas variantes de operação HC DSV4 usadas pelo qwen4exp. Esta atualização inclui implementações específicas para hc_pre com porta sigmoide por elemento e hc_post com mistura de identidade.
- Suporte para qwen4exp hc_pre com porta sigmoide por elemento (variante com porta)
- Suporte para qwen4exp hc_post com mistura de identidade (comb == nullptr)
- Novos binários disponíveis para macOS, Linux, Windows, Android e openEuler em CPU, GPU e backends especializados como CUDA, ROCm e OpenVINO.
Este lançamento permite que os usuários executem modelos que utilizam essas operações específicas de aceleração de hardware em uma ampla gama de plataformas compatíveis.