Prism-ML telah merilis model Ternary-Bonsai-27B, yang tersedia sebagai checkpoint GGUF di Hugging Face.
Rilis ini menyediakan varian 27 miliar parameter dari arsitektur Qwen3.6 yang dioptimalkan untuk inferensi lokal melalui format GGUF.
Prism-ML telah merilis model Ternary-Bonsai-27B, yang tersedia sebagai checkpoint GGUF di Hugging Face.
Rilis ini menyediakan varian 27 miliar parameter dari arsitektur Qwen3.6 yang dioptimalkan untuk inferensi lokal melalui format GGUF.
Rilis llama.cpp b10677 mengatasi bug kritis di backend Vulkan di mana ketergantungan view-alias yang hilang menyebabkan pengoptimal graf salah mengurutkan node.
Rilis llama.cpp b10676 memperbaiki bug di `conv_transpose_2d` di mana hanya batch pertama yang dihitung, meninggalkan batch berikutnya sebagai nol. Perbaikan ini berlaku untuk pustaka inti ggml dan implementasi backend Metal.
Proyek llama.cpp merilis build b10673, yang mencakup optimasi kinerja spesifik untuk perangkat keras Apple M4. Pembaruan ini memperkenalkan catatan fa_vec_tuned_table ke dalam modul ggml-metal-tuning untuk meningkatkan efisiensi backend Metal.
Proyek llama.cpp merilis versi b10670, yang mencakup optimasi khusus untuk arsitektur Xe2 Intel. Pembaruan ini mengarahkan operasi decode kunci-nilai (KV) terkuantisasi secara eksklusif ke backend TILE untuk perangkat keras BMG, sambil mempertahankan backend VEC pada arsitektur lain hingga divalidasi.
Proyek llama.cpp merilis build b10672, yang memperbarui backend OpenVINO ke versi 2026.3.1 dan menambahkan dukungan untuk model Whisper.cpp pada NPU.
Kami menggunakan cookie untuk mengukur lalu lintas dan meningkatkan situs. Anda dapat menerima atau menolak cookie analitik. Kebijakan privasi