PaddlePaddle telah memperkenalkan HPD-Parsing, model parsing dokumen ringan dengan 1 miliar parameter yang memanfaatkan paradigma Hierarchical Parallel Decoding untuk meningkatkan throughput. Arsitektur ini mengoordinasikan struktur halaman global melalui cabang tata letak utama sambil mendistribusikan generasi konten terlokalisasi ke cabang-cabang konkuren, dengan memanfaatkan Progressive Multi-Token Prediction untuk mengurangi langkah dekoding.

  • HPD-Parsing mencapai skor keseluruhan 94,91% pada OmniDocBench v1.6, menetapkan state of the art baru di antara parser terpadu end-to-end.
  • Model ini mencapai throughput puncak sebesar 4.752 Tokens Per Second (TPS), yang 3,06 kali lebih cepat daripada baseline autoregresifnya dan 2,62 kali lebih cepat daripada parser dokumen paling cepat yang ada saat ini.
  • Strategi adaptasi bertahap dengan kurasi data otomatis yang sadar kesulitan mempertahankan akurasi parsing selama transisi ke dekoding paralel.

Pendekatan ini menunjukkan bahwa parsing dokumen dapat dieksekusi secara efektif melalui koordinasi tata letak global dan dekoding paralel terlokalisasi, alih-alih satu jalur generasi sekuensial tunggal.