A Prism-ML lançou o modelo Ternary-Bonsai-27B, disponível como checkpoints GGUF no Hugging Face.
O lançamento fornece uma variante de 27 bilhões de parâmetros da arquitetura Qwen 3.6 otimizada para inferência local por meio do formato GGUF.
A Prism-ML lançou o modelo Ternary-Bonsai-27B, disponível como checkpoints GGUF no Hugging Face.
O lançamento fornece uma variante de 27 bilhões de parâmetros da arquitetura Qwen 3.6 otimizada para inferência local por meio do formato GGUF.
O lançamento llama.cpp b10677 corrige um bug crítico no backend Vulkan onde a ausência de dependências view-alias fazia o otimizador de grafos reordenar os nós incorretamente.
A versão b10676 do llama.cpp corrige um bug no `conv_transpose_2d` onde apenas o primeiro lote era computado, deixando os lotes subsequentes como zero. Esta correção se aplica tanto à biblioteca central ggml quanto à implementação do backend Metal.
O projeto llama.cpp lançou a compilação b10673, que inclui otimizações específicas de desempenho para hardware Apple M4. Esta atualização introduz registros fa_vec_tuned_table no módulo ggml-metal-tuning para melhorar a eficiência do backend Metal.
O projeto llama.cpp lançou a versão b10670, que inclui uma otimização específica para a arquitetura Xe2 da Intel. A atualização direciona a operação de decodificação de chave-valor (KV) quantizada exclusivamente para o backend TILE em hardware BMG, mantendo o backend VEC em outras arquiteturas até que sejam validadas.
O projeto llama.cpp lançou a compilação b10672, que atualiza o backend do OpenVINO para a versão 2026.3.1 e adiciona suporte a modelos Whisper.cpp no NPU.
Usamos cookies para medir o tráfego e melhorar o site. Você pode aceitar ou recusar os cookies de análise. Política de privacidade