Le projet llama.cpp a publié la compilation b10649, qui introduit une nouvelle fonctionnalité d'acceptation spéculative synthétique. Cet ajout est spécifiquement conçu à des fins de benchmarking et est disponible dans les composants llama-server et llama-cli.
- Ajoute l'acceptation spéculative synthétique uniquement pour les benchmarks à llama-server et llama-cli.
- Inclut les binaires pour macOS, iOS, Linux, Windows, Android et openEuler via CPU, GPU et divers backends d'accélération.
- Désactive le support de KleidiAI sur macOS Apple Silicon pour cette compilation.
Cette version fournit des binaires mis à jour pour une large gamme de plateformes tout en ajoutant des outils spécifiques pour évaluer les performances du décodage spéculatif.