Prism-ML은 Hugging Face에서 GGUF 체크포인트로 제공되는 Ternary-Bonsai-27B 모델을 출시했습니다.
이번 릴리스는 GGUF 형식을 통해 로컬 추론에 최적화된 Qwen3.6 아키텍처의 270억 파라미터 변형을 제공합니다.
Prism-ML은 Hugging Face에서 GGUF 체크포인트로 제공되는 Ternary-Bonsai-27B 모델을 출시했습니다.
이번 릴리스는 GGUF 형식을 통해 로컬 추론에 최적화된 Qwen3.6 아키텍처의 270억 파라미터 변형을 제공합니다.
llama.cpp b10677 릴리스는 누락된 뷰-얼리아스 의존성으로 인해 그래프 최적화 노드가 노드를 잘못 재배열하는 Vulkan 백엔드의 치명적인 버그를 해결합니다.
llama.cpp 릴리스 b10676은 첫 번째 배치만 계산되고 이후 배치가 0으로 남아 있는 `conv_transpose_2d`의 버그를 수정했습니다. 이 수정은 핵심 ggml 라이브러리와 Metal 백엔드 구현 모두에 적용됩니다.
llama.cpp 프로젝트가 Apple M4 하드웨어를 위한 특정 성능 최적화를 포함하는 빌드 b10673을 출시했습니다. 이 업데이트는 Metal 백엔드 효율성을 개선하기 위해 ggml-metal-tuning 모듈에 fa_vec_tuned_table 레코드를 도입합니다.
llama.cpp 프로젝트는 Intel의 Xe2 아키텍처를 위한 특정 최적화를 포함하는 버전 b10670을 출시했습니다. 이 업데이트는 양자화된 키-값(KV) 디코드 작업을 BMG 하드웨어에 대해 TILE 백엔드 전용으로 라우팅하며, 다른 아키텍처에서는 검증될 때까지 VEC 백엔드를 유지합니다.
llama.cpp 프로젝트가 빌드 b10672를 출시했으며, 이는 OpenVINO 백엔드를 버전 2026.3.1로 업데이트하고 NPU에서 Whisper.cpp 모델에 대한 지원을 추가합니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침