llama.cpp प्रोजेक्ट ने embeddingGemma2 मॉडल के लिए समर्थन जोड़ा है, जो पाठ, दृश्य और ऑडियो इनपुट को संभालता है। यह अपडेट pull request #30054 के माध्यम से लागू किया गया है।
llama.cpp ने embeddingGemma2 मल्टीमोडल एम्बेडिंग्स के लिए समर्थन जोड़ा है
llama.cpp v0.6.0 में विस्तृत बैच API, GLM-5.3-Flash समर्थन और निर्णय मॉडल एंडपॉइंट्स जोड़े गए
llama.cpp v0.6.0 मिश्रित टोकन और एम्बेडिंग इनपुट के लिए नया llama_batch_ext विस्तृत बैच API पेश करता है, साथ ही GLM-5.3-Flash 320B हाइब्रिड मॉडल और Clef निर्णय मॉडल का समर्थन भी।
llama.cpp b11240 में /v1/embeddings के लिए टाइप्ड मल्टीमोडल इनपुट सपोर्ट जोड़ा गया
llama.cpp सर्वर अब /v1/embeddings एंडपॉइंट के लिए टाइप्ड कंटेंट (विजन, ऑडियो, वीडियो) इनपुट का समर्थन करता है। यह अपडेट ओपेनएआई-स्टाइल से बंद किए गए कंटेंट ऐरे को स्वीकार करके मल्टीमोडल एम्बेडिंग अनुरोधों को सक्षम बनाता है, जिससे टेक्स्ट और image_url हिस्सों को एक साथ प्रोसेस किया जा सकता है।
Liquid AI ने LFM2.5-VL-3B-DSpark स्पेकुलेटिव ड्राफ्टर जारी किया, जो 3.13x तक तेज़ डिकोडिंग प्रदान करता है
Liquid AI ने अपने LFM2.5-VL-3B विजन-लैंग्वेज मॉडल के लिए एक प्रायोगिक स्पेकुलेटिव-डिकोडिंग ड्राफ्ट मॉडल, LFM2.5-VL-3B-DSpark जारी किया है। इस ड्राफ्टर में लगभग 280M पैरामीटर जोड़े गए हैं और मॉडल के आउटपुट वितरण को बदले बिना टोकन जनरेशन को तेज़ किया गया है।
Liquid AI ने दृश्य-भाषा मॉडल निष्पादन को तेज़ करने के लिए LFM2.5-VL-DSpark जारी किया
Liquid AI ने LFM2.5-VL-3B दृश्य-भाषा मॉडल के लिए निष्पादन को तेज़ करने के लिए एक अनुमानित डिकोडिंग ड्राफ्टर, LFM2.5-VL-DSpark ड्राफ्ट मॉडल जारी किया है। ड्राफ्टर उम्मीदवार टोकन उत्पन्न करने के लिए लक्ष्य मॉडल के स्थिर परतों से छिपी अवस्थाओं को पकड़ता है, जिसमें केवल 280M पैरामीटर (8.9% ओवरहेड) जुड़े हैं जबकि सभी मोडेलिटीज़ में समान आयाम बनाए रखे गए हैं।
Liquid AI ने LFM2.5-VL-3B के लिए DSpark ड्राफ्ट मॉडल जारी किया
Liquid AI ने अपने विजन-लैंग्वेज मॉडल LFM2.5-VL-3B के लिए एक प्रायोगिक DSpark ड्राफ्ट मॉडल जारी किया है, जो आउटपुट गुणवत्ता को बदले बिना एज डिवाइसों और GPU पर तेज़ डिकोडिंग सक्षम करता है।