La versión b10772 de llama.cpp amplía la cobertura de operaciones unarias F16 del backend Hexagon Tensor Processor (HTP) añadiendo soporte para la función valor absoluto (ABS).
- La actualización introduce los kernels y despachadores hvx_abs_f16 en hvx-arith.h, reflejando la estructura existente de sqr_f16.
- ABS se registra como una operación HTP_OP_UNARY soportada, permitiendo que ggml_hexagon_precompute_unary_params rellene los parámetros del kernel para nodos F16.
- La base de código fusiona las funciones separadas execute_op_unary_f32 y f16 en una única función execute_op_unary para evitar duplicar la infraestructura VTCM/DMA.
- La verificación en dispositivo en QRD8850 (Hexagon v81) confirmó 8/8 pruebas superadas para ABS F16 y F32 sin fallback a CPU.
Este cambio permite cálculos eficientes de valor absoluto en precisión FP16 en hardware Hexagon compatible, ampliando el rango de operaciones unarias soportadas para inferencia móvil.