NVIDIA выпустила модель Qwen3.6-27B-NVFP4 на Hugging Face.
Проверочная точка теперь доступна для загрузки.
NVIDIA выпустила модель Qwen3.6-27B-NVFP4 на Hugging Face.
Проверочная точка теперь доступна для загрузки.
Авторы представляют Quantization-Aware Healing (QAH), конвейер, который дистиллирует студентов 4-битных моделей непосредственно из несжатых моделей для восстановления производительности, потерянной во время структурного сжатия и квантования. Примененный к GPT-OSS 120B, этот метод производит Hypernova-60B, который соответствует или превосходит источник bfloat16 на 7 из 9 бенчмарков, используя примерно в 4 раза меньше памяти весов.
Авторы представляют Quantization-Aware Healing (QAH), метод восстановления способностей к рассуждению и написанию кода в структурно сжатых больших языковых моделях на 4 бита. В отличие от стандартного обучения с учётом квантования, которое переобучает сжатую модель, QAH дистиллирует студента 4-битной модели напрямую из исходной несжатой модели.
NVIDIA продемонстрировала развертывание модели Qwen 3.8 2.4T с параметрами и настраиваемыми возможностями рассуждения на аппаратной платформе GB300 NVL72.
Qwen выпустила открытые веса для своей модели Qwen 3.8 27B. Чекпоинт доступен на Hugging Face.
Alibaba выпустила открытые веса для Qwen3.8-2.4T-A95B (также известной как Qwen3.8-Max), своей крупнейшей модели с открытыми весами, предназначенной для предоставления возможностей, близких к передовым, в открытой экосистеме.
Мы используем cookie для аналитики и улучшения сайта. Вы можете принять или отклонить аналитические cookie. Политика конфиденциальности