El proyecto llama.cpp ha lanzado la compilación b11048, que introduce soporte para las nuevas variantes de operación HC DSV4 utilizadas por qwen4exp. Esta actualización incluye implementaciones específicas para hc_pre con puerta sigmoidea por elemento y hc_post con mezcla de identidad.
- Soporte para qwen4exp hc_pre con puerta sigmoidea por elemento (variante con puerta)
- Soporte para qwen4exp hc_post con mezcla de identidad (comb == nullptr)
- Nuevos binarios disponibles para macOS, Linux, Windows, Android y openEuler en CPU, GPU y backends especializados como CUDA, ROCm y OpenVINO.
Este lanzamiento permite a los usuarios ejecutar modelos que utilizan estas operaciones específicas de aceleración de hardware en una amplia gama de plataformas compatibles.