O projeto llama.cpp lançou a compilação b10649, que introduz um novo recurso de aceitação especulativa sintética. Esta adição é projetada especificamente para fins de benchmark e está disponível nos componentes llama-server e llama-cli.
- Adiciona aceitação especulativa sintética apenas para benchmark ao llama-server e llama-cli.
- Inclui binários para macOS, iOS, Linux, Windows, Android e openEuler através de CPU, GPU e vários backends de acelerador.
- Desativa o suporte do KleidiAI no macOS Apple Silicon para esta compilação.
Este lançamento fornece binários atualizados para uma ampla gama de plataformas enquanto adiciona ferramentas específicas para avaliar o desempenho da decodificação especulativa.