أطلقت تشنغ تنغ نموذج EVIE-4.5B، وهو نموذج عالي الأداء للاسترجاع البصري متعدد اللغات للوثائق، يتميز بـ Prefix-Multivector Retrieval Latency (Prefix-MRL) الديناميكي وضغط الرموز عبر التجميع الهرمي المتراكم (HAC) دون الحاجة إلى تدريب.
- يحقق EVIE-4.5B نتيجة 66.02 على ViDoRe V3 Public باستخدام Prefix-MRL ذو الإسقاط الواحد، بينما حقق النموذج الأكبر EVIE-8B نتيجة 66.75.
- يدعم النموذج اقتطاع الأبعاد أثناء التشغيل من 2048D إلى 64D دون الحاجة إلى نماذج منفصلة، مع الحفاظ على دقة استرجاع عالية عبر جميع الأحجام.
- يقوم HAC غير المدرب بضغط عدد الرموز من حوالي 750 متجهًا لكل صفحة إلى 32، مما يقلل تخزين الفهرس إلى 3.81 GiB لكل مليون صفحة.
- تم تقييم النموذج عبر 138 مهمة متعددة اللغات على ViDoRe V1 وV2 وV3 وJinaVDR، مما أظهر أداءً قويًا في الإنجليزية والفرنسية والألمانية والإسبانية والعربية والصينية.
- تم استخلاص EVIE-4.5B من المعلم EVIE-8B باستخدام وصفة EVIE-ARD، التي تستخدم تقنيات التقطير العلائقي الحافظ على النواة والقادر على إدراك السعة.
يوفر هذا الإصدار حلاً مرناً للاسترجاع البصري للوثائق يوازن بين الدقة العالية والمتطلبات التخزينية المنقصة بشكل كبير من خلال أبعاد التضمين الديناميكية وضغط الرموز.