Первоначальное тестирование модели DeepSeek v4 Flash указывает на заметные улучшения её навыков проектирования пользовательского интерфейса и пользовательского опыта. Несмотря на эти улучшения, отмечается, что модель потребляет много токенов.
Первоначальное тестирование DeepSeek v4 Flash показывает значительные улучшения в возможностях дизайна UI/UX
PIVOT разделяет сканирование префиксов между группами запросов для ускорения разреженного внимания на уровне токенов
PIVOT (Proxy Indexing Via One full-prefix Traversal) — это решение без дообучения, заменяющее индексатор DeepSeek Sparse Attention (DSA), которое снижает вычислительную избыточность за счёт общего сканирования одного префикса для группы близких запросов. Вместо оценки каждого предыдущего токена для каждого запроса отдельно PIVOT объединяет группу в один прокси-запрос для получения набора кандидатов, из которых для каждого запроса выбираются топ-k токенов.
Кластеризованная кодовая книга для сжатия изображений на основе 2D Гауссиан
Исследователи представляют Cluster-Guided Vector Quantization (CGVQ), метод, разработанный для улучшения показателей rate-distortion в сжатии изображений на основе гауссовых примитивов. Подход разделяет параметры Гаусса на однородные группы перед квантованием, устраняя неэффективность, вызванную хранением большого количества параметров с плавающей запятой для каждого примитива.
Diffusers добавляет нативную поддержку вывода Nunchaku Lite с 4-битным квантованием
Hugging Face Diffusers теперь поддерживает загрузку контрольных точек Nunchaku Lite напрямую через `from_pretrained()`, что устраняет необходимость в отдельном движке вывода или локальной компиляции CUDA. Эта интеграция использует метод SVDQuant для выполнения слоёв трансформера с 4-битными весами и активациями (W4A4), что значительно снижает потребление памяти и одновременно повышает скорость вывода.
Пользователь запрашивает INT8-квантование ConvRot для FireRed Image Edit v1.1
Пользователь на форумах Hugging Face интересуется потенциальной разработкой версии ConvRot с квантованием INT8 или FP8 для модели FireRed Image Edit v1.1.
ZimengXiong перенёс Hunyuan3D в MLX для Apple Silicon и iPhone
Разработчик ZimengXiong завершил порт Swift-MLX и Python MLX моделей Hunyuan3D-Paint и Hunyuan3D-Shape, что позволяет выполнять локальную генерацию 3D по изображениям на устройствах Apple Silicon. Работа распространяется в виде десктопного приложения Modelr с открытым исходным кодом для macOS и iOS, а также исходного кода для интеграции технологии в Swift-приложения.