O projeto llama.cpp lançou a compilação b10649, que introduz um novo recurso de aceitação especulativa sintética. Esta adição é projetada especificamente para fins de benchmark e está disponível nos componentes llama-server e llama-cli.

  • Adiciona aceitação especulativa sintética apenas para benchmark ao llama-server e llama-cli.
  • Inclui binários para macOS, iOS, Linux, Windows, Android e openEuler através de CPU, GPU e vários backends de acelerador.
  • Desativa o suporte do KleidiAI no macOS Apple Silicon para esta compilação.

Este lançamento fornece binários atualizados para uma ampla gama de plataformas enquanto adiciona ferramentas específicas para avaliar o desempenho da decodificação especulativa.