Prism-ML выпустила модель Ternary-Bonsai-27B, доступную в виде контрольных точек GGUF на Hugging Face.
Выпуск представляет собой вариант архитектуры Qwen 3.6 с 27 миллиардами параметров, оптимизированный для локального вывода через формат GGUF.
Prism-ML выпустила модель Ternary-Bonsai-27B, доступную в виде контрольных точек GGUF на Hugging Face.
Выпуск представляет собой вариант архитектуры Qwen 3.6 с 27 миллиардами параметров, оптимизированный для локального вывода через формат GGUF.
Выпуск llama.cpp b10677 устраняет критическую ошибку во внутреннем механизме Vulkan, из-за которой отсутствие зависимостей alias-представлений приводило к некорректной перестановке узлов оптимизатором графа.
Выпуск llama.cpp b10676 исправляет ошибку в `conv_transpose_2d`, где вычислялся только первый пакет, а последующие оставались нулевыми. Это исправление применяется как к основной библиотеке ggml, так и к реализации бэкенда Metal.
Проект llama.cpp выпустил сборку b10673, включающую специфические оптимизации производительности для аппаратного обеспечения Apple M4. Это обновление вводит записи fa_vec_tuned_table в модуль ggml-metal-tuning для повышения эффективности бэкенда Metal.
Проект llama.cpp выпустил версию b10670, которая включает специфическую оптимизацию для архитектуры Intel Xe2. Обновление перенаправляет операцию декодирования квантованных ключей и значений (KV) исключительно на бэкенд TILE для оборудования BMG, сохраняя бэкенд VEC для других архитектур до их валидации.
Проект llama.cpp выпустил сборку b10672, которая обновляет бэкенд OpenVINO до версии 2026.3.1 и добавляет поддержку моделей Whisper.cpp на NPU.
Мы используем cookie для аналитики и улучшения сайта. Вы можете принять или отклонить аналитические cookie. Политика конфиденциальности