O projeto llama.cpp lançou a versão b10229, que inclui uma correção crítica para o backend do OpenCL. A atualização aborda um problema onde os dados de profiling falhavam em serem escritos durante o término do programa.
- A correção incrementa o `ref_count` em `ggml_backend_opencl_init()` para evitar que se torne -1 no método `free()`.
- Isso garante que os dados de profiling sejam corretamente despejados e salvos quando `GGML_OPENCL_PROFILING` está habilitado.
- Os binários estão disponíveis para macOS, Linux, Windows, Android e openEuler através dos backends CPU, CUDA, Vulkan, ROCm, OpenVINO, SYCL e HIP.
Esta mudança garante que os usuários que dependem do profiling do OpenCL possam capturar e analisar com sucesso as métricas de desempenho sem perda de dados.