El proyecto llama.cpp lanzó la versión b10951, que incluye una optimización de código en la lógica de decodificación. La llamada a la función `llama_n_rs_seq` ahora se ejecuta antes de `llama_decode`, permitiendo al sistema devolver directamente si la comprobación pasa.
- Este cambio elimina la necesidad de configurar la variable `res` y usar una sentencia goto cuando se cumple la condición de retorno anticipado.
- La motivación principal es evitar invocar `llama_decode` cuando no es necesario, mejorando la eficiencia.
- Los binarios están disponibles para macOS (Apple Silicon e Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) y openEuler.