Le projet llama.cpp a publié la version b10549, qui introduit principalement le support du split de tenseurs dans les modèles LFM2 et LFM2MOE.

  • La mise à jour inclut des binaires pour macOS (Apple Silicon et Intel), Linux (Ubuntu x64, arm64, s390x avec backends CPU, Vulkan, OpenVINO et SYCL), Windows (CPU, CUDA 12/13, Vulkan, OpenCL, ROCm) et Android.
  • Le support iOS est fourni via un XCFramework.
  • Les builds openEuler sont disponibles pour les architectures x86 et aarch64 en utilisant ACL Graph.

Cette version fournit des binaires mis à jour sur plusieurs plateformes pour faciliter l'exécution des modèles LFM2/LFM2MOE avec la nouvelle capacité de split de tenseurs.