llama.cpp 프로젝트는 여러 wgsl 파일의 리팩토링과 ggml-webgpu 구성 요소 내 flash_attn wgsl 의 단순화를 포함하는 버전 b10336 을 출시했습니다.

이 업데이트는 macOS (Apple Silicon 및 Intel), iOS, Linux (CPU, Vulkan, ROCm 7.2, OpenVINO, SYCL 가 있는 Ubuntu), Android, Windows (CPU, OpenCL, CUDA 12/13, Vulkan, OpenVINO, SYCL, HIP), openEuler 플랫폼용 바이너리를 제공합니다.

릴리스에는 사용자가 모델 추론 엔진과 상호 작용할 수 있는 표준 UI 빌드도 포함되어 있습니다.