llama.cpp 프로젝트는 WebGPU 백엔드에 대한 주요 업데이트를 포함하는 빌드 b11382를 출시했습니다. 이 릴리스는 WebGPU 구현 내에서 `fill` 및 `set_rows` 작업에 대해 16비트 부동 소수점(f16) 지원을 추가합니다.

  • 소스 코드 변경 사항은 ggml-org/llama.cpp 저장소의 풀 리퀘스트 #29897에서 추적됩니다.
  • macOS(Apple Silicon 및 Intel), iOS, Linux(CPU, Vulkan, CUDA 12/13, ROCm, OpenVINO, SYCL, Snapdragon), Windows(CPU, OpenCL, CUDA, Vulkan, OpenVINO, SYCL, ROCm), Android 및 openEuler에 대한 바이너리가 제공됩니다.
  • 릴리스에는 표준 llama.cpp UI 바이너리도 포함되어 있습니다.