llama.cpp b10772 版本通过添加对绝对值(ABS)函数的支持,扩展了 Hexagon Tensor Processor (HTP) 后端的 F16 一元运算覆盖范围。

  • 该更新在 hvx-arith.h 中引入了 hvx_abs_f16 内核和调度器,与现有的 sqr_f16 结构相呼应。
  • ABS 被注册为支持的 HTP_OP_UNARY 操作,允许 ggml_hexagon_precompute_unary_params 为 F16 节点填充内核参数。
  • 代码库将单独的 execute_op_unary_f32 和 f16 函数合并为单个 execute_op_unary 函数,以避免重复 VTCM/DMA 底层实现。
  • 在 QRD8850 (Hexagon v81) 上的设备端验证确认 F16 和 F32 ABS 的 8/8 项测试通过,且无 CPU 回退。

此更改使兼容 Hexagon 硬件上能够高效执行 FP16 精度的绝对值计算,扩展了移动推理支持的 unary 运算范围。