llama.cpp 프로젝트는 디코딩 로직에 코드 최적화를 포함한 버전 b10951을 출시했습니다. `llama_n_rs_seq` 함수 호출은 이제 `llama_decode` 전에 실행되어 검사가 통과하면 시스템이 직접 반환할 수 있습니다.

  • 이 변경으로 조기 반환 조건이 충족될 때 `res` 변수를 설정하고 goto 문을 사용할 필요가 사라졌습니다.
  • 주요 동기는 필요하지 않을 때 `llama_decode`를 호출하지 않아 효율성을 향상시키는 것입니다.
  • 바이너리는 macOS (Apple Silicon 및 Intel), iOS, Linux (CPU, Vulkan, ROCm, OpenVINO, SYCL), Android, Windows (CPU, CUDA 12/13, Vulkan, OpenVINO, SYCL, ROCm) 및 openEuler에서 사용할 수 있습니다.