Le projet llama.cpp a publié la version b11260, introduisant le support des fonctions d'activation FP32 GELU_ERF et GEGLU_ERF dans le backend Hexagon. Cette mise à jour inclut également des optimisations pour réduire la pression sur les registres au sein des noyaux associés.
- Ajout du support FP32 GELU_ERF et GEGLU_ERF pour Hexagon.
- Réduction de la pression sur les registres dans les noyaux hexagon.
- Binaires disponibles pour macOS Apple Silicon, Intel et iOS.
- Les compilations Linux couvrent CPU, Vulkan, CUDA 12/13, ROCm 10.0, OpenVINO, SYCL et les plateformes Snapdragon.
- Les compilations Android arm64 incluent le support du NPU Snapdragon Hexagon.
- Les versions Windows proposent des options CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL et ROCm 10.0.
Cette version étend la compatibilité matérielle pour des fonctions d'activation spécifiques et améliore l'efficacité sur les accélérateurs pris en charge.