La version b10772 de llama.cpp étend la couverture des opérations unaires F16 du backend Hexagon Tensor Processor (HTP) en ajoutant le support de la fonction valeur absolue (ABS).

  • La mise à jour introduit les noyaux et les dispatchers hvx_abs_f16 dans hvx-arith.h, en miroir de la structure sqr_f16 existante.
  • ABS est enregistré comme une opération HTP_OP_UNARY prise en charge, permettant à ggml_hexagon_precompute_unary_params de remplir les paramètres du noyau pour les nœuds F16.
  • La base de code fusionne les fonctions séparées execute_op_unary_f32 et f16 en une seule fonction execute_op_unary afin d'éviter la duplication du mécanisme VTCM/DMA.
  • La vérification sur l'appareil QRD8850 (Hexagon v81) a confirmé 8/8 tests réussis pour ABS F16 et F32 sans retour à CPU.

Ce changement permet des calculs de valeur absolue efficaces en précision FP16 sur le matériel Hexagon compatible, élargissant la gamme des opérations unaires prises en charge pour l'inférence mobile.