Tencent выпустила EVIE-Preview-4.5B, передовую многоязычную модель поиска по визуальным документам (VDR), созданную на базе Qwen3.5-4B. Модель использует позднее взаимодействие в стиле ColBERT с нативными многовекторными токенизированными эмбеддингами размерности 128 для достижения высоких результатов на бенчмарках ViDoRe.
- Превосходит более крупные модели на 8B параметрах в ViDoRe V3, лидируя в 7 из 8 публичных доменов.
- Демонстрирует среднюю точность 85.93 nDCG@5 на ViDoRe V1+V2.
- Поддерживает устойчивую обобщающую способность без обучения (zero-shot) для различных языков (EN, FR, DE, IT, ES, PT, ZH) и визуальных форматов.
- Полностью интегрирована со стандартной экосистемой colpali-engine для конвейеров оценки с поздним взаимодействием.
Модель обучена на примерно 0.8 миллионах высококачественных пар «изображение-запрос» и использует динамический отбор и верификацию для повышения качества обучающих данных.