El proyecto llama.cpp ha lanzado la compilación b11048, que introduce soporte para las nuevas variantes de operación HC DSV4 utilizadas por qwen4exp. Esta actualización incluye implementaciones específicas para hc_pre con puerta sigmoidea por elemento y hc_post con mezcla de identidad.

  • Soporte para qwen4exp hc_pre con puerta sigmoidea por elemento (variante con puerta)
  • Soporte para qwen4exp hc_post con mezcla de identidad (comb == nullptr)
  • Nuevos binarios disponibles para macOS, Linux, Windows, Android y openEuler en CPU, GPU y backends especializados como CUDA, ROCm y OpenVINO.

Este lanzamiento permite a los usuarios ejecutar modelos que utilizan estas operaciones específicas de aceleración de hardware en una amplia gama de plataformas compatibles.