Источник · Tencent Hunyuan (HF)
lab Tencent Hunyuan (HF) · 16 д назад · 42 просмотра

Tencent выпустила документальные парсеры WeVisDoc-2B и WeVisDoc-4B

Tencent выпустила WeVisDoc, сквозной документальный парсер для изображений страниц, дообученный на моделях Qwen3-VL. Система преобразует изображения страниц в структурированный Markdown, включая формулы LaTeX и HTML-таблицы.

lab Tencent Hunyuan (HF) · 16 д назад · 82 просмотра

Tencent выпустила WeVisDoc-4B, сквозной парсер документов

Tencent выпустила WeVisDoc-4B, сквозной парсер документов для изображений страниц, который преобразует страницы в структурированный Markdown с формулами LaTeX и HTML-таблицами. Модель, дообученная на базе Qwen3-VL-4B-Instruct, достигает общего балла 95.38 на OmniDocBench v1.6 и занимает первое место среди сравниваемых парсеров во всех четырех указанных настройках.

lab Tencent Hunyuan (HF) · 19 д назад · 21 просмотр

Tencent выпустила чекпоинты Simple Attention Sparsification для Qwen3

Tencent выпустила чекпоинты Simple Attention Sparsification (SAS), которые учатся ранжировать и выбирать KV-блоки для каждого запроса в моделях Qwen3. В отличие от методов, дистиллирующих плотные оценки внимания, SAS добавляет непрерывные гейты к выбранным блокам, что позволяет проводить сквозную оптимизацию ранжирования контекста с использованием функции потерь языкового моделирования.

lab Tencent Hunyuan (HF) · 24 д назад · 35 просмотров

Tencent выпустила открытую базовую модель AuK для генерации и редактирования речи

Tencent сделала свою базовую модель AuK 1.5B для генерации и редактирования речи доступной как программное обеспечение с открытым исходным кодом, включая код и веса модели.

lab Tencent Hunyuan (HF) · 24 д назад · 32 просмотра

Tencent выпустила открытую модель генерации речи AuK-Flash, дистиллированную версию на 1.5B параметров

Tencent сделала фундаментальную модель AuK для генерации и редактирования речи доступной в открытом исходном коде, включая код и веса на Hugging Face и ModelScope. В релиз входит AuK-Flash, дистиллированный вариант, предназначенный для быстрого вывода всего за 4 шага.

lab Tencent Hunyuan (HF) · 26 д назад · 41 просмотр

Tencent выпустила EVIE-4.5B с динамическим Prefix-MRL и сжатием токенов без дообучения

Tencent выпустила EVIE-4.5B, высокопроизводительную многоязычную модель визуального поиска документов, использующую динамический Prefix-Multivector Retrieval Latency (Prefix-MRL) и сжатие токенов на основе иерархического агломеративного кластеризации (HAC) без дообучения.

lab Tencent Hunyuan (HF) · 26 д назад · 32 просмотра

Tencent выпустила EVIE-8B — модель визуального поиска документов с 4096D

Tencent выпустила EVIE-8B, высокопроизводительную модель визуального поиска документов, использующую 4096-мерные токенизированные представления и двунаправленное полное внимание. Модель служит базовой учителем для облегчённой вариации EVIE-4.5B Prefix-MRL и демонстрирует лучшие результаты на бенчмарках визуального поиска документов.