llama.cpp b10677 릴리스는 누락된 뷰-얼리아스 의존성으로 인해 그래프 최적화 노드가 노드를 잘못 재배열하는 Vulkan 백엔드의 치명적인 버그를 해결합니다.
- 수정은 `is_src_of`가 하나의 텐서의 두 뷰를 종속적으로 올바르게 처리하도록 보장하여, 탐욕 디코딩과 추론 디코딩 중 침묵 오류를 방지합니다.
- NONE, RESHAPE, TRANSPOSE, VIEW 또는 PERMUTE와 같은 연산을 가진 노드는 더 이상 얼리아스 의존성으로 취급되지 않으며, 정확성을 해치지 않고 최적화기의 자유도를 복원합니다.
- 코드는 람다 매개변수를 const로 만들고 `is_src_of`에서 `is_empty`를 캡처하여 컴파일되며, 비const 포인터의 가시성 문제를 해결합니다.
- 이 변경은 AMD 및 NVIDIA Vulkan 하드웨어에서 Qwen3.8과 같은 모델의 재귀적 상태 문제를 구체적으로 수정하며, CUDA는 영향을 받지 않습니다.
이 릴리스는 이슈 #27805를 해결하고 CPU, GPU 및 다양한 가속기 백엔드에 대해 macOS, Linux, Windows, Android 및 openEuler용 바이너리를 제공합니다.