Ling-3.0-flash-VL — это новая модель, созданная на архитектуре Ling-3.0-flash, которая внедряет возможности визуального понимания и работы с визуальными агентами.
Модель демонстрирует высокие результаты в нескольких областях, включая визуальное восприятие, рассуждения в области STEM, интеллектуальный анализ документов, задачи мультимодальных агентов, фронтенд-разработку и интерпретацию медицинских отчетов.
Это обновление расширяет базовую функциональность модели, позволяя ей эффективно обрабатывать и взаимодействовать с визуальными данными.