أضاف مشروع llama.cpp دعمًا لنموذج embeddingGemma2، الذي يتعامل مع مدخلات النص والرؤية والصوت. يتم تنفيذ هذا التحديث عبر طلب السحب #30054.
llama.cpp يضيف دعمًا للتضمينات متعددة الوسائط لـ embeddingGemma2
يضيف llama.cpp v0.6.0 واجهة برمجة تطبيقات الدفعات الموسعة، ودعم GLM-5.3-Flash، ونقاط نهاية نماذج اتخاذ القرار
يقدم llama.cpp v0.6.0 واجهة برمجة التطبيقات الجديدة llama_batch_ext للدفعات الموسعة لإدخالات الرموز والميزات المدمجة المختلطة، بالإضافة إلى دعم النموذج الهجين GLM-5.3-Flash 320B ونموذج القرار Clef.
يضيف llama.cpp b11240 دعم الإدخال متعدد الوسائط المtyped إلى /v1/embeddings
يدعم خادم llama.cpp الآن إدخال محتوى مtyped (رؤية، صوت، فيديو) لنقطة النهاية /v1/embeddings. يتيح هذا التحديث طلبات تضمين متعددة الوسائط عن طريق قبول مصفوفات المحتوى المغلفة على طراز OpenAI، مما يسمح بمعالجة أجزاء النص وimage_url معًا.
Liquid AI تطلق LFM2.5-VL-3B-DSpark كمسوّق تخميني لتسريع فك التشفير بنسبة تصل إلى 3.13x
أطلقت Liquid AI نموذج LFM2.5-VL-3B-DSpark، وهو نموذج مسوّق تجريبي لفك التشفير التخميني الخاص بنموذجها اللغوي-البصري LFM2.5-VL-3B. يضيف المسوّق حوالي 280 مليون معامل ويسرّع توليد الرموز دون تغيير توزيع مخرجات النموذج.
Liquid AI تطلق LFM2.5-VL-DSpark لتسريع استنتاج نماذج الرؤية واللغة
أطلقت Liquid AI نموذج LFM2.5-VL-DSpark المسود، وهو مُعدّ للفك التأملي مصمم لتسريع الاستدلال لنموذج الرؤية واللغة LFM2.5-VL-3B. يلتقط المُعدّ الحالات المخفية من الطبقات الثابتة للنموذج المستهدف لتوليد رموز مرشحة، مضيفاً فقط 280M معامل (فائض بنسبة 8.9%) مع الحفاظ على أبعاد متطابقة عبر الوسائط.
Liquid AI تطلق نموذج DSpark الأولي لـ LFM2.5-VL-3B
أطلقت Liquid AI نموذج DSpark الأولي التجريبي لنموذج الرؤية واللغة الخاص بها LFM2.5-VL-3B، مما يتيح فك تشفير أسرع على الأجهزة الطرفية ووحدة المعالجة الرسومية دون تغيير جودة الإخراج.