LFM2.5-VL-3B melhora a compreensão de tela e a chamada de funções para implantação em dispositivos de borda
O LFM2.5-VL-3B é um novo modelo de visão e linguagem que oferece desempenho competitivo em comparação com modelos maiores, mantendo baixa latência para aplicações em tempo real e em dispositivos. Ele se baseia na versão anterior do LFM2-VL-3B com melhorias significativas na compreensão de tela, fundamentação (grounding), chamada de funções e capacidades de entrada de múltiplas imagens.