Prism-ML 发布了 Ternary-Bonsai-27B 模型,该模型在 Hugging Face 上以 GGUF 检查点形式提供。
此次发布提供了针对通过 GGUF 格式进行本地推理优化的 Qwen 3.6 架构的 270 亿参数变体。
Prism-ML 发布了 Ternary-Bonsai-27B 模型,该模型在 Hugging Face 上以 GGUF 检查点形式提供。
此次发布提供了针对通过 GGUF 格式进行本地推理优化的 Qwen 3.6 架构的 270 亿参数变体。
llama.cpp b10677 版本解决了 Vulkan 后端中的一个关键错误,其中缺失的 view-alias 依赖导致图优化器错误地重排序节点。
llama.cpp b10676 版本修正了 `conv_transpose_2d` 中的错误,该错误导致仅计算了第一个批次,而后续批次保持为零。此修复适用于核心 ggml 库和 Metal 后端实现。
llama.cpp 项目发布了构建版本 b10673,其中包含针对 Apple M4 硬件的特定性能优化。此更新在 ggml-metal-tuning 模块中引入了 fa_vec_tuned_table 记录,以提升 Metal 后端的效率。
llama.cpp 项目发布了版本 b10670,其中包括针对 Intel Xe2 架构的特定优化。该更新将量化键值 (KV) 解码操作专门路由到 BMG 硬件的 TILE 后端,同时在其他架构验证之前继续使用 VEC 后端。
llama.cpp 项目发布了构建版本 b10672,将 OpenVINO 后端更新至 2026.3.1 版本,并增加了对 NPU 上 Whisper.cpp 模型的支持。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策