Proyek llama.cpp telah merilis build b11048, yang memperkenalkan dukungan untuk varian operasi HC DSV4 baru yang digunakan oleh qwen4exp. Pembaruan ini mencakup implementasi spesifik untuk hc_pre dengan gerbang sigmoid per-elemen dan hc_post dengan pencampuran identitas.

  • Dukungan untuk qwen4exp hc_pre dengan gerbang sigmoid per-elemen (varian bergerbang)
  • Dukungan untuk qwen4exp hc_post dengan pencampuran identitas (comb == nullptr)
  • Biner baru tersedia untuk macOS, Linux, Windows, Android, dan openEuler di CPU, GPU, dan backend khusus seperti CUDA, ROCm, dan OpenVINO.

Rilis ini memungkinkan pengguna menjalankan model yang memanfaatkan operasi akselerasi perangkat keras spesifik ini di berbagai platform yang didukung.