Liquid AI는 엣지 디바이스에서 향상되고 빠른 성능을 제공하도록 설계된 30억 파라미터의 비전-라이트 모델인 LFM2.5-VL-3B를 출시했습니다. 이 모델은 SigLIP2 400M NaFlex 비전 인코더와 이전 텍스트 전용 버전의 백본을 결합했으며, 이전 출시 대비 4배 더 많은 비전 데이터를 포함해 약 34조 개의 토큰으로 학습되었습니다.
- 주요 기능으로는 화면 및 UI 이해도 향상, 객체 감지를 위한 그라운딩 개선, 다중 이미지 추론, 텍스트 전용 및 비전-텍스트 컨텍스트 모두에서 강화된 함수 호출이 포함됩니다.
- 이 모델은 약 3GB의 메모리에 적합하며, M5 Max에서 초당 228개 토큰, Ryzen AI Max+ 395에서 초당 116개 토큰으로 디코딩하고, Galaxy S26 Ultra에서는 초당 20개 토큰에 도달합니다.
- GPU 추론 시 높은 동시성에서 초당 약 11K 개 토큰을 달성하며, 이는 더 큰 4B 클래스 모델의 처리량보다 약 두 배 빠르고 작은 2B 클래스 모델보다 앞섭니다.
이번 출시는 일일 디바이스 워크로드를 위한 강력하고 범용적인 비전-라이트 지능을 제공하며, llama.cpp, MLX, vLLM, SGLang, ONNX와 같은 추론 프레임워크에 대한 당일 지원을 포함합니다.