Qwen выпустила открытые веса для своей модели Qwen 3.8 27B. Чекпоинт доступен на Hugging Face.
Qwen выпустила открытые веса для Qwen 3.8 27B
PrismML выпустила Bonsai 27B, сжимая Qwen3.6-27B до 1-битных и тернарных весов
PrismML выпустила Bonsai 27B, квантование с низким битом модели Qwen3.6-27B, которое позволяет запускать большие мультимодальные модели на ноутбуках и телефонах без переобучения.
Qwen3.5 122B A10B в формате UD-Q2_K_XL помещается в 64 ГБ ОЗУ и улучшает внутренние знания
Пользователь демонстрирует, что модель Qwen3.5 122B A10B, квантованная с помощью UD-Q2_K_XL, может поместиться в 64 ГБ системной оперативной памяти, заменяя предыдущий лучший вариант для данного ограничения.
Тернарная Qwen3.6 27B работает на 60 ток/с на двух RTX 3090
Пользователь сообщает об успешном запуске тернарно-квантованной модели Qwen3.6 27B на двух GPU NVIDIA RTX 3090. Конфигурация обеспечивает пропускную способность 60 токенов в секунду со стабильной функцией вызова инструментов.
PrismML сжимает Qwen3.6-27B до <4 ГБ для iPhone
PrismML разработала сжатую версию открытой модели Qwen 3.6 от Alibaba, позволяющую запускать большую языковую модель на 27 миллиардов параметров на iPhone 17 Pro. Стартап уменьшил размер модели с примерно 54 гигабайт до менее чем 4 гигабайт с помощью математического метода, основанного на исследованиях Калифорнийского технологического института.
NVIDIA выпустила модель Qwen3.6-27B-NVFP4
NVIDIA выпустила модель Qwen3.6-27B-NVFP4 на Hugging Face.