PaddlePaddle представила HPD-Parsing, легковесную модель для разбора документов на 1 миллиард параметров, которая использует парадигму иерархического параллельного декодирования для повышения пропускной способности. Архитектура координирует глобальную структуру страницы через основной ветвь разметки, одновременно направляя генерацию локализованного контента в параллельные ветви, применяя прогрессивное многозадачное предсказание для сокращения шагов декодирования.
- HPD-Parsing достигает общего балла 94.91% на OmniDocBench v1.6, устанавливая новый рекорд среди сквозных унифицированных парсеров.
- Модель достигает пиковой пропускной способности в 4 752 токена в секунду (TPS), что в 3.06 раза быстрее её авторегрессионного базового варианта и в 2.62 раза быстрее самого быстрого из существующих парсеров документов.
- Стратегия поэтапной адаптации с автоматическим отбором данных с учётом сложности сохраняет точность разбора при переходе к параллельному декодированию.
Этот подход демонстрирует, что разбор документов может эффективно выполняться через координацию глобальной разметки и локализованное параллельное декодирование, а не через единую последовательную траекторию генерации.