O projeto llama.cpp lançou a versão b10430, que introduz suporte para dispositivos de GPU integrada (igpu) virtuais. Esta atualização também inclui comentários melhorados na base de código.
A versão fornece binários e frameworks para macOS (Apple Silicon e Intel), iOS, Linux (Ubuntu com CPU, Vulkan, OpenVINO, SYCL e ROCm desativado), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL e ROCm 7.14) e arquiteturas openEuler.
Esta atualização permite que os usuários executem o llama.cpp em sistemas que utilizam configurações de igpu virtual em uma ampla gama de sistemas operacionais e aceleradores de hardware.