Proyek llama.cpp merilis versi b10955, yang mencakup perbaikan kritis untuk korupsi heap di dalam backend ggml-cpu. Pembaruan ini menonaktifkan header pra-kompilasi (PCH) dan menghapus definisi CACHE_LINE_SIZE yang ambigu untuk menyelesaikan masalah keamanan memori.
- Menonaktifkan PCH ggml-cpu memulihkan urutan include alami, memastikan ops.h diproses sebelum header interferensi perangkat keras.
- Menghapus cabang std::hardware_destructive_interference_size membuat CACHE_LINE_SIZE deterministik dan independen dari urutan include.
- Perbaikan ini menyelesaikan ketidaksesuaian di mana kernel C++ menggunakan baris cache 256-byte sementara kode C menggunakan fallback 64-byte, yang sebelumnya membuat buffer kerja rope terlalu kecil.
- Koreksi ini mencegah crash heap-buffer-overflow di ggml_compute_forward_rope_flt yang disebabkan oleh perbedaan ukuran buffer.
Rilis ini menyediakan biner untuk platform macOS (Apple Silicon dan Intel), Linux (x64, arm64, s390x), Windows (CPU, CUDA, Vulkan, ROCm, OpenVINO, SYCL), Android, dan openEuler.