المختبر · Tencent
arxiv arXiv cs.CL · منذ 5 يوم · 8 مشاهدات

يقوم KuaFu بضغط سلوك المستخدم إلى فهم على نطاق المليار

تقدم Tencent نظام KuaFu، وهو طبقة موحدة لضغط السلوك تقوم بتكثيف سجل المستخدم الخام إلى تمثيلات مضغوطة لوكلاء المحادثة وأنظمة التوصية. يستخدم النظام مُوجِّهًا ثنائي المحور لضغط كل عنصر سلوكي إلى 2-4 رموز بعرض 128-256، مما يعالج الاختناقات في معالجة التسلسلات الطويلة لمليار مستخدم.

media r/LocalLLaMA · منذ 15 يوم · 25 مشاهدة

Naive AI تُقيّم بمليار و400 مليون دولار، تخطط لإصدار نموذج لغوي كبير بوزن مفتوح

أكملت Naive AI، وهي شركة ناشئة تعمل في الخفاء أسسها البروفيسور داي جيفينغ من جامعة تسينغهوا، ثلاث جولات من التمويل totaling 400 مليون دولار، مما وصل بتقييمها إلى أكثر من 1.4 مليار دولار. تستعد الشركة لإطلاق نموذجها اللغوي الكبير الأول، المسمى أيضًا Naive، كإصدار بوزن مفتوح في أقرب وقت هذا الشهر.

lab Tencent Hunyuan (HF) · منذ 16 يوم · 82 مشاهدة

تيانتينغ تطلق WeVisDoc-4B، محلل مستندات من البداية للنهاية

أطلقت تيانتينغ WeVisDoc-4B، وهو محلل مستندات من البداية للنهاية لصور الصفحات يحول الصفحات إلى Markdown هيكلي مع صيغ LaTeX وجداول HTML. تم ضبطه بدقة من Qwen3-VL-4B-Instruct، حقق النموذج درجة إجمالية تبلغ 95.38 على OmniDocBench v1.6 ويتصدر المراكز بين محللات المستندات المقارنة في جميع الإعدادات الأربعة المذكورة.

lab Tencent Hunyuan (HF) · منذ 19 يوم · 21 مشاهدة

تencent تطلق نقاط فحص Simple Attention Sparsification لـ Qwen3

أطلقت Tencent نقاط فحص Simple Attention Sparsification (SAS) التي تتعلم ترتيب واختيار كتل KV لكل استعلام في نماذج Qwen3. على عكس الطرق التي تستخلص درجات الانتباه الكثيفة، تضيف SAS بوابات مستمرة إلى الكتل المختارة، مما يتيح التحسين الشامل لترتيب السياق باستخدام خسارة نمذجة اللغة.

lab Tencent Hunyuan (HF) · منذ 24 يوم · 32 مشاهدة

تيانتسنت تطلق نموذج توليد الكلام AuK-Flash مفتوح المصدر والمضغوط بـ 1.5 مليار معلمة

أعلنت تيانتسنت عن إتاحة نموذج الأساس AuK لتوليد الكلام وتحريره كمصدر مفتوح، بما في ذلك الكود والأوزان على منصتي Hugging Face وModelScope. يتضمن الإصدار متغير AuK-Flash المضغوط المصمم للاستدلال السريع بخطوات فقط 4.

lab Tencent Hunyuan (HF) · منذ 26 يوم · 41 مشاهدة

تشنغ تنغ تطلق EVIE-4.5B مع Prefix-MRL الديناميكي وضغط الرموز دون تدريب

أطلقت تشنغ تنغ نموذج EVIE-4.5B، وهو نموذج عالي الأداء للاسترجاع البصري متعدد اللغات للوثائق، يتميز بـ Prefix-Multivector Retrieval Latency (Prefix-MRL) الديناميكي وضغط الرموز عبر التجميع الهرمي المتراكم (HAC) دون الحاجة إلى تدريب.

lab Tencent Hunyuan (HF) · منذ 26 يوم · 32 مشاهدة

تينسنت تُطلق EVIE-8B، نموذج استرجاع الوثائق المرئية ذو البُعد 4096D

أطلقت تينسنت نموذج EVIE-8B، وهو نموذج عالي السعة لاسترجاع الوثائق المرئية يتميز بتمثيلات للرموز (tokens) ذات بُعد 4096 واهتمام كامل ثنائي الاتجاه. يعمل النموذج كأساس للمعلم (teacher foundation) للنسخة الخفيفة من EVIE-4.5B Prefix-MRL ويحقق أداءً متفوقاً في معايير استرجاع الوثائق المرئية.