Le projet llama.cpp a publié la compilation b11048, qui introduit le support des nouvelles variantes d'opération HC DSV4 utilisées par qwen4exp. Cette mise à jour inclut des implémentations spécifiques pour hc_pre avec une porte sigmoïde par élément et hc_post avec un mélange d'identité.

  • Support de qwen4exp hc_pre avec porte sigmoïde par élément (variante avec porte)
  • Support de qwen4exp hc_post avec mélange d'identité (comb == nullptr)
  • Nouveaux binaires disponibles pour macOS, Linux, Windows, Android et openEuler sur CPU, GPU et backends spécialisés tels que CUDA, ROCm et OpenVINO.

Cette version permet aux utilisateurs d'exécuter des modèles utilisant ces opérations spécifiques d'accélération matérielle sur une large gamme de plateformes prises en charge.