El proyecto llama.cpp ha liberado la versión b10312, que incluye una actualización específica al componente del servidor. El cambio clave aborda un problema en el que los modelos ocupados estaban siendo expulsados del enrutador.

  • Servidor: Evita la expulsión de modelos ocupados (PR #26567).
  • macOS/iOS: Proporciona binarios para Apple Silicon (arm64) e Intel (x64), junto con un iOS XCFramework. El soporte de KleidiAI en macOS está desactivado.
  • Linux: Ofrece compilaciones para Ubuntu x64, arm64 y CPUs s390x, así como variantes de Vulkan, ROCm 7.2, OpenVINO, SYCL FP32 y SYCL FP16.
  • Android: Incluye una compilación para CPU arm64.
  • Windows: Admite CPUs x64 y arm64, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL e HIP.
  • openEuler: Están disponibles compilaciones para x86 (310p, 910b ACL Graph) y aarch64 (310p, 910b ACL Graph), mientras que la solicitud de extracción estándar está desactivada.

Esta liberación garantiza la disponibilidad continua de modelos activos en implementaciones del servidor y proporciona binarios completos en los principales sistemas operativos y aceleradores de hardware.