Proyek llama.cpp telah merilis build b10649, yang memperkenalkan fitur baru penerimaan spekulatif sintetis. Penambahan ini secara khusus dirancang untuk tujuan benchmarking dan tersedia di komponen llama-server dan llama-cli.

  • Menambahkan penerimaan spekulatif sintetis hanya untuk benchmark ke llama-server dan llama-cli.
  • Termasuk biner untuk macOS, iOS, Linux, Windows, Android, dan openEuler melalui CPU, GPU, dan berbagai backend akselerator.
  • Menonaktifkan dukungan KleidiAI di macOS Apple Silicon untuk build ini.

Rilis ini menyediakan biner yang diperbarui untuk berbagai platform sambil menambahkan alat khusus untuk mengevaluasi kinerja decoding spekulatif.