El proyecto llama.cpp ha lanzado la versión b11157, introduciendo soporte para operaciones de convolución 3D utilizando GEMM implícito en CUDA. Esta actualización refina la implementación para manejar núcleos vacíos y está disponible en una amplia gama de plataformas incluyendo macOS, Linux, Windows, Android e iOS.

  • Añade conv3d con GEMM implícito para backends de CUDA.
  • Refina la lógica de GEMM implícito de conv3d para manejar correctamente núcleos vacíos.
  • Proporciona binarios para CPU, Vulkan, ROCm, OpenVINO, SYCL y Snapdragon en Linux y Windows.
  • Incluye compilaciones para macOS Apple Silicon (arm64), macOS Intel (x64) e iOS XCFramework.
  • Ofrece compilaciones de Android arm64 con soporte para CPU, GPU Adreno y NPU Hexagon.

Esta versión expande las capacidades de aceleración por hardware de la biblioteca al habilitar operaciones de convolución 3D en GPUs NVIDIA.