O projeto llama.cpp lançou a versão b10638, que implementa suporte ao Vulkan para as funções `cross_entropy_loss` e `cross_entropy_loss_back`.

  • O lançamento inclui binários pré-compilados para macOS (Apple Silicon e Intel), Linux (Ubuntu x64, arm64, s390x), Windows (x64 e arm64), Android (arm64) e openEuler.
  • A aceleração de GPU está disponível via Vulkan, CUDA (12.4, 13.3, 13.4 preview), ROCm 7.14, OpenCL Adreno, SYCL e OpenVINO nas plataformas suportadas.
  • As compilações do macOS Apple Silicon com KleidiAI estão atualmente desativadas neste lançamento.
  • Um pacote de interface do usuário atualizado também é fornecido junto com os binários principais.