Liquid AI는 효율적인 온디바이스 배포를 위해 설계된 3.1B 파라미터의 비전-언어 모델인 LFM2.5-VL-3B를 출시했습니다. 이 모델은 모바일, 웹, 데스크톱 환경에서 디지털 화면을 읽고, 객체를 좌표에 매핑하며, 문서를 구문 분석하고, 텍스트 또는 이미지 입력으로부터 도구 호출을 실행합니다.

  • 성능: 28개 비전 벤치마크에서 평균 69.4점을 기록하여 InternVL-3.5-4B와 동급이며 Qwen3.5-4B보다 0.7점 뒤처집니다.
  • 새로운 기능: 함수 호출(ToolSandbox 59.5, BFCL v4 32.5)과 개선된 그라운딩(RefCOCO-avg 87.9)을 도입했습니다.
  • 효율성: 약 3 GB의 메모리에 적합하며 Apple M5 Max에서 초당 228토큰을 디코딩합니다.
  • 라이선싱: 연간 매출 1천만 달러 미만 기업은 상업적 사용이 무료이며, 더 큰 기업은 라이선스를 협상해야 합니다.

이 모델은 낮은 지연 시간을 유지하기 위해 추론 기능이 없으며, llama.cpp, MLX, vLLM, SGLang, ONNX 런타임을 지원하는 네이티브, GGUF, ONNX, MLX 형식으로 제공됩니다.