llama.cpp 프로젝트는 빌드 b10273을 출시하여 백엔드 샘플링 제약으로 인해 초기화 중에 히스토리 기반 샘플러가 올바른 컨텍스트 길이를 추론할 수 없었던 심각한 문제를 해결했습니다.
- 초기화 오류를 수정하기 위해 샘플러에 대해 ctx-len 대신 -1에서 1024로 해결합니다.
- 히스토리 기반 샘플러에 대해 공유 기본값 64를 설정하고 context_size 매개변수를 제거합니다.
- CPU, GPU(CUDA, Vulkan, ROCm, SYCL) 및 OpenVINO 백엔드를 통해 macOS, Linux, Windows, Android 및 openEuler용 바이너리를 제공합니다.
이 업데이트는 완전한 llama_context가 아직 사용 가능하지 않은 초기 구축 단계 동안 안정적인 샘플러 동작을 보장합니다.