O projeto llama.cpp lançou a versão b11260, introduzindo suporte para as funções de ativação FP32 GELU_ERF e GEGLU_ERF no backend Hexagon. Esta atualização também inclui otimizações para reduzir a pressão de registradores nos kernels associados.
- Adicionado suporte FP32 GELU_ERF e GEGLU_ERF para Hexagon.
- Reduzida a pressão de registradores nos kernels hexagon.
- Binários disponíveis para macOS Apple Silicon, Intel e iOS.
- As compilações do Linux cobrem CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL e plataformas Snapdragon.
- As compilações do Android arm64 incluem suporte para o NPU Snapdragon Hexagon.
- Os lançamentos para Windows oferecem opções de CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL e ROCm 10.0.
Esta versão expande a compatibilidade com hardware para funções de ativação específicas e melhora a eficiência nos aceleradores suportados.