LFM2.5-VL-3B meningkatkan pemahaman layar dan pemanggilan fungsi untuk penyebaran di perangkat tepi
LFM2.5-VL-3B adalah model visi-bahasa baru yang memberikan kinerja kompetitif dibandingkan dengan model yang lebih besar sambil mempertahankan latensi rendah untuk aplikasi waktu nyata dan di perangkat. Model ini dibangun dari rilis LFM2-VL-3B sebelumnya dengan peningkatan signifikan dalam pemahaman layar, grounding, pemanggilan fungsi, dan kemampuan input multi-gambar.