Le projet llama.cpp a publié la version b10229, qui inclut une correction critique pour le backend OpenCL. La mise à jour résout un problème où les données de profilage n'étaient pas écrites lors de la terminaison du programme.

  • La correction incrémente `ref_count` dans `ggml_backend_opencl_init()` pour empêcher qu'il ne devienne -1 dans la méthode `free()`.
  • Cela garantit que les données de profilage sont correctement vidées et sauvegardées lorsque `GGML_OPENCL_PROFILING` est activé.
  • Les binaires sont disponibles pour macOS, Linux, Windows, Android et openEuler via les backends CPU, CUDA, Vulkan, ROCm, OpenVINO, SYCL et HIP.

Ce changement garantit que les utilisateurs dépendant du profilage OpenCL peuvent capturer et analyser avec succès les métriques de performance sans perte de données.