O lançamento llama.cpp b10814 expande o suporte ao backend OpenCL adicionando nove novas operações unárias elementares e melhorando os kernels de movimentação de dados.

  • Adicionadas operações unárias elementares estendidas, incluindo sgn, step, elu, hardswish, hardsigmoid, floor, ceil, round e trunc para evitar fallbacks para CPU.
  • Implementado um kernel de cópia f32 contíguo que é distribuído por todo o dispositivo para movimentos lineares, otimizando o desempenho para tensores com poucas linhas longas.
  • Suporte ao CONCAT estendido a todos os tipos de fácil cópia (f16, bf16, i8, i16, i32, i64) através da chaveagem de kernels no tamanho do elemento em vez do tipo específico.

Essas alterações melhoram a cobertura e eficiência do OpenCL para backends não-CPU em macOS, Linux, Windows e Android.