O projeto llama.cpp lançou a versão b10604, introduzindo suporte ao formato de modelo Deepseek 4 (DSV4) junto com novos binários pré-compilados para macOS e iOS.

  • Adiciona suporte a tensores sm do Deepseek 4 (DSV4) com granularidade mais grossa para divisões de cabeças e correções para dspark.
  • Habilita o salvamento de modelos para DSV4 e permite que o dflash retorne em dispositivos específicos.
  • Inclui funcionalidade de allreduce atrasado para especialistas compartilhados.
  • Fornece binários para Apple Silicon no macOS, XCFrameworks para iOS, e binários atualizados para Linux, Windows, Android e openEuler através de CPU, GPU e backends especializados.

Este lançamento permite que os usuários executem modelos Deepseek 4 usando o llama.cpp e fornece builds nativas atualizadas para dispositivos Apple.