La versión llama.cpp b10814 amplía el soporte del backend de OpenCL añadiendo nueve nuevas operaciones unarias elementales y mejorando los núcleos de movimiento de datos.

  • Se añadieron operaciones unarias elementales extendidas, incluyendo sgn, step, elu, hardswish, hardsigmoid, floor, ceil, round y trunc para evitar la caída en CPU.
  • Se implementó un núcleo de copia f32 contiguo que se distribuye por todo el dispositivo para movimientos lineales, optimizando el rendimiento para tensores con pocas filas largas.
  • Se amplió el soporte de CONCAT a todos los tipos de fácil copia (f16, bf16, i8, i16, i32, i64) claveando los núcleos en el tamaño del elemento en lugar del tipo específico.

Estos cambios mejoran la cobertura y eficiencia de OpenCL para backends no-CPU en macOS, Linux, Windows y Android.