El proyecto llama.cpp ha lanzado la compilación b10653, introduciendo la función TENSOR_READ_LAZY en su cargador de modelos. Este cambio incluye la adición de la función TENSOR_GET_ROW_LAZY y una bandera correspondiente --tensor-read-lazy en la línea de comandos.

  • Añadidos TENSOR_READ_LAZY y TENSOR_GET_ROW_LAZY al cargador de modelos.
  • Introducida la opción CLI --tensor-read-lazy para habilitar la lectura perezosa de tensores.
  • Proporcionados binarios para macOS (Apple Silicon e Intel), Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm), Android e iOS.

Esta versión actualiza la biblioteca principal con nuevas capacidades de carga diferida mientras distribuye binarios precompilados a través de las plataformas compatibles.