Prism-MLはTernary-Bonsai-27Bモデルをリリースし、Hugging FaceでGGUFチェックポイントとして利用可能です。
このリリースでは、GGUF形式を通じてローカル推論に最適化されたQwen3.6アーキテクチャの270億パラメータ版が提供されています。
Prism-MLはTernary-Bonsai-27Bモデルをリリースし、Hugging FaceでGGUFチェックポイントとして利用可能です。
このリリースでは、GGUF形式を通じてローカル推論に最適化されたQwen3.6アーキテクチャの270億パラメータ版が提供されています。
llama.cpp b10677 リリースは、Vulkan バックエンドにおける重大なバグに対処します。このバグでは、ビューエイリアスの依存関係が欠落していたため、グラフ最適化ノードの順序が誤って入れ替えられていました。
llama.cpp リリース b10676 は、`conv_transpose_2d` のバグを修正しました。このバグでは最初のバッチのみが計算され、以降のバッチがゼロのままになっていました。この修正はコア ggml ライブラリと Metal バックエンドの実装の両方に適用されます。
llama.cpp プロジェクトは、Apple M4 ハードウェア向けの特定の性能最適化を含むビルド b10673 をリリースしました。このアップデートは、Metal バックエンドの効率を向上させるために ggml-metal-tuning モジュールに fa_vec_tuned_table レコードを導入します。
llama.cpp プロジェクトはバージョン b10670 をリリースし、Intel の Xe2 アーキテクチャ用の特定の最適化が含まれています。この更新では、量子化されたキーバリュー (KV) デコード操作を BMG ハードウェアに対して TILE バックエンドのみにルーティングし、他のアーキテクチャについては検証されるまで VEC バックエンドを維持します。
llama.cppプロジェクトはビルドb10672をリリースし、OpenVINOバックエンドをバージョン2026.3.1に更新し、NPU上のWhisper.cppモデルのサポートを追加しました。
アクセス解析とサイト改善のために Cookie を使用します。分析 Cookie を許可または拒否できます。 プライバシーポリシー