llama.cpp 프로젝트가 버전 b10094를 출시하여, 초안 저장소 사이드카에서 스펜크티브 디코딩 유형을 자동으로 감지하는 기능을 도입했습니다. 이전에는 `-hfd` 플래그를 사용하여 mtp-, dflash-, 또는 eagle3- 사이드카를 포함하는 저장소를 가리키지만 `--spec-type`을 명시적으로 제공하지 않으면, 시스템이 초안을 전체 모델로 잘못 해석했습니다.
이번 업데이트로 스펜크티브 유형이 지정되지 않은 경우, llama-server는 초안 저장소에서 사용 가능한 사이드카를 발견하고 mtp, dflash, eagle3의 우선순위 순서에 따라 첫 번째 것을 선택합니다. 이를 통해 사용자는 추가 플래그 없이 `llama-server -hf repo:Q3_K_M -hfd repo:Q8_0`와 같은 명령을 실행할 수 있습니다. 명시적인 `--spec-type` 인수는 이 자동 추론을 비활성화합니다.
이번 릴리스에는 macOS(Apple Silicon 및 Intel), iOS, Linux(Ubuntu x64/arm64/s390x with CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL), Android arm64, Windows(CPU, OpenCL Adreno, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), 그리고 openEuler용 바이너리가 포함되어 있습니다.