Laboratório · 01.AI
lab Liquid AI · há 2 d Berkeley Function-Calling Leaderboard · 32.5% · 15 visualizações

LFM2.5-VL-3B melhora a compreensão de tela e a chamada de funções para implantação em dispositivos de borda

O LFM2.5-VL-3B é um novo modelo de visão e linguagem que oferece desempenho competitivo em comparação com modelos maiores, mantendo baixa latência para aplicações em tempo real e em dispositivos. Ele se baseia na versão anterior do LFM2-VL-3B com melhorias significativas na compreensão de tela, fundamentação (grounding), chamada de funções e capacidades de entrada de múltiplas imagens.

arxiv arXiv cs.AI · há 3 d

MiLMMT-46-v1.0 melhora a tradução multilíngue por meio de pós-treinamento sem referência

Pesquisadores desenvolveram o MiLMMT-46-v1.0, um modelo de tradução automática multilíngue que aplica pós-treinamento sem referência em grandes modelos de linguagem de código aberto. A equipe utiliza Otimização de Política Relativa de Grupo (GRPO) com uma recompensa baseada em dois modelos de estimativa de qualidade sem referência, controlada por identificação de idioma.

arxiv arXiv cs.CL · há 3 d · 1 visualização

MiLMMT-46-v1.0 melhora a tradução multilíngue por meio de pós-treinamento sem referência

Pesquisadores lançaram o MiLMMT-46-v1.0, um modelo de linguagem grande de código aberto para tradução automática multilíngue que utiliza pós-treinamento sem referência. Partindo do MiLMMT-46-v0.1 ajustado por supervisão, a equipe aplicou Group Relative Policy Optimization (GRPO) com uma recompensa baseada em dois modelos de estimativa de qualidade sem referência, controlados por identificação de idioma.