Proyek llama.cpp telah merilis build b10649, yang memperkenalkan fitur baru penerimaan spekulatif sintetis. Penambahan ini secara khusus dirancang untuk tujuan benchmarking dan tersedia di komponen llama-server dan llama-cli.
- Menambahkan penerimaan spekulatif sintetis hanya untuk benchmark ke llama-server dan llama-cli.
- Termasuk biner untuk macOS, iOS, Linux, Windows, Android, dan openEuler melalui CPU, GPU, dan berbagai backend akselerator.
- Menonaktifkan dukungan KleidiAI di macOS Apple Silicon untuk build ini.
Rilis ini menyediakan biner yang diperbarui untuk berbagai platform sambil menambahkan alat khusus untuk mengevaluasi kinerja decoding spekulatif.