llama.cpp 프로젝트는 ggml-cpu 백엔드 내의 힙 손상에 대한 치명적인 수정을 포함한 버전 b10955를 출시했습니다. 이 업데이트는 메모리 안전 문제를 해결하기 위해 사전 컴파일된 헤더(PCH)를 비활성화하고 모호한 CACHE_LINE_SIZE 정의를 제거합니다.

  • ggml-cpu PCH 비활성화는 자연스러운 include 순서를 복원하여 ops.h가 하드웨어 간섭 헤더보다 먼저 처리되도록 보장합니다.
  • std::hardware_destructive_interference_size 분기 제거는 CACHE_LINE_SIZE를 결정론적으로 만들고 include 순서에 독립적으로 만듭니다.
  • 이 수정은 C++ 커널이 256바이트 캐시 라인을 사용하는 반면 C 코드가 64바이트 폴백을 사용하던 불일치를 해결했으며, 이는 이전에 rope 작업 버퍼의 크기가 부족했었습니다.
  • 이 보정은 버퍼 크기 차이로 인해 발생한 ggml_compute_forward_rope_flt의 힙 버퍼 오버플로우 충돌을 방지합니다.

이 릴리스는 macOS(Apple Silicon 및 Intel), Linux(x64, arm64, s390x), Windows(CPU, CUDA, Vulkan, ROCm, OpenVINO, SYCL), Android 및 openEuler 플랫폼에 대한 바이너리를 제공합니다.