Ling-3.0-flash-VL adalah model baru yang dibangun di atas arsitektur Ling-3.0-flash yang memperkenalkan kemampuan pemahaman visual dan agen visual.
Model ini berkinerja baik di beberapa domain, termasuk persepsi visual, penalaran STEM, kecerdasan dokumen, tugas agen multimodal, pengodean frontend, dan interpretasi laporan medis.
Rilis ini memperluas utilitas model dasar dengan memungkinkannya memproses dan berinteraksi dengan data visual secara efektif.