ラボ · 01.AI
lab Liquid AI · 3日前 Berkeley Function-Calling Leaderboard · 32.5% · 15 回表示

LFM2.5-VL-3Bがエッジ展開向けの画面理解と関数呼び出しを改善

LFM2.5-VL-3Bは、リアルタイムおよびオンデバイスアプリケーションの低レイテンシを維持しつつ、より大規模なモデルに対抗する競争力のあるパフォーマンスを提供する新しいビジョン・ランゲージモデルです。これは以前のLFM2-VL-3Bリリースを基盤としており、画面理解、グラウンディング、関数呼び出し、マルチイメージ入力機能において大幅な強化が図られています。

arxiv arXiv cs.CL · 3日前 · 1 回表示

MiLMMT-46-v1.0 は参照なしのポストトレーニングにより多言語翻訳を改善

研究者らは、参照なしのポストトレーニングを活用する多言語機械学習のためのオープンな大規模言語モデルである MiLMMT-46-v1.0 を公開した。教師ありファインチューニングされた MiLMMT-46-v0.1 から出発し、チームは言語識別によってゲート制御される2つの参照なし品質推定モデルに基づく報酬を用いた Group Relative Policy Optimization (GRPO) を適用した。