O projeto llama.cpp lançou a versão b10604, introduzindo suporte ao formato de modelo Deepseek 4 (DSV4) junto com novos binários pré-compilados para macOS e iOS.
- Adiciona suporte a tensores sm do Deepseek 4 (DSV4) com granularidade mais grossa para divisões de cabeças e correções para dspark.
- Habilita o salvamento de modelos para DSV4 e permite que o dflash retorne em dispositivos específicos.
- Inclui funcionalidade de allreduce atrasado para especialistas compartilhados.
- Fornece binários para Apple Silicon no macOS, XCFrameworks para iOS, e binários atualizados para Linux, Windows, Android e openEuler através de CPU, GPU e backends especializados.
Este lançamento permite que os usuários executem modelos Deepseek 4 usando o llama.cpp e fornece builds nativas atualizadas para dispositivos Apple.