La version llama.cpp b10814 élargit le support du backend OpenCL en ajoutant neuf nouvelles opérations unaires élémentaires et en améliorant les noyaux de déplacement de données.
- Ajout d'opérations unaires élémentaires étendues, notamment sgn, step, elu, hardswish, hardsigmoid, floor, ceil, round et trunc pour éviter les retours au CPU.
- Implémentation d'un noyau de copie f32 continu qui se répartit sur tout le dispositif pour les mouvements linéaires, optimisant les performances pour les tenseurs avec peu de lignes longues.
- Extension du support CONCAT à tous les types facilement copiables (f16, bf16, i8, i16, i32, i64) en utilisant la taille de l'élément comme clé plutôt que le type spécifique.
Ces modifications améliorent la couverture et l'efficacité d'OpenCL pour les backends non-CPU sur macOS, Linux, Windows et Android.