O projeto llama.cpp lançou a compilação b10568, que atualiza o tratamento de modelos para usar a função `ggml_rope_set_offset()`. Esta alteração é parcialmente aplicada para suportar o DeepSeek 2.

  • O lançamento inclui binários para macOS (Apple Silicon e Intel), Linux (Ubuntu x64, arm64, s390x), Windows, Android e openEuler.
  • Os backends suportados incluem CPU, Vulkan, ROCm 7.14, OpenVINO, SYCL, CUDA 12/13 e OpenCL Adreno.
  • macOS Apple Silicon com KleidiAI e Ubuntu x64 com ROCm 7.14 estão atualmente desabilitados nesta compilação.