المختبر · Alibaba (Qwen)
media MarkTechPost · منذ 12 يوم · 35 مشاهدة

أليبا Qwen تطلق Qwen3.8-Omni-Flash، نموذجًا متعدد الوسائط ذاتيًا مع سياق يصل إلى 1 مليون رمز

أطلقت فريق Qwen التابع لشركة أليبا الإصدار Qwen3.8-Omni-Flash، وهو أول نموذج متعدد الوسائط مصمم حول القدرات الذاتية للاستخدام في فهم الصوت والفيديو واستخدام الأدوات. يقبل النموذج مدخلات نصية وصورًا وصوتًا وفيديو لإرجاع مخرجات نصية، ويتميز بنافذة سياق تتسع لـ 1 مليون رمز ودعم استدعاء الوظائف بشكل أصلي.

media MarkTechPost · منذ 2 يوم · 4 مشاهدات

ألبابا كوين تطلق نموذج الصوت ثنائي الاتجاه الكامل Qwen-Audio-3.1-Realtime

أطلقت فريق كوين التابع لألبابا مجموعة نماذج صوتية مكونة من خمسة نماذج، تشمل Qwen-Audio-3.1-Realtime-plus الجديد، وهو نموذج كلام ثنائي الاتجاه مصمم لوكلاء الصوت القادرين على الاستدلال واستخدام الأدوات. كما يتضمن الإطلاق تخفيضات في الأسعار تصل إلى 95% على خدمات التعرف التلقائي على الكلام (ASR).

media r/LocalLLaMA · منذ 2 يوم GPQA Diamond · 91.41% · 19 مشاهدة

إصدار ISTA لنماذج GSQ-RCO GGUF الخاصة بـ Qwen3.8-Flash-Next وإصدار Coder المقتطع بنسبة 50% من الخبراء

أصدر مختبر خوارزميات ISTA العميق والأنظمة إصدارات GGUF المُكمّاة للنموذج ذو الخبراء المتناثرين Qwen3.8-Flash-Next، جنباً إلى جنب مع بناء تجريبي مستهدف القدرات تمت إزالة نصف خبراءه.

arxiv arXiv cs.AI · منذ 2 يوم · مشاهدة واحدة

تستخدم RareDx تحسين السياسة المستندة إلى الرسم البياني لتحسين تشخيص الأمراض النادرة

يقدم المؤلفون نظام RareDx، الذي يربط بين الاستخدام الخاضع للرقابة للأدلة وتحسين السياسة المستندة إلى رسم بياني للمعرفة لمعالجة مشكلة الاستدلال ذي الذيل الطويل في تشخيص الأمراض النادرة. يجمع خط التدريب بين ما بعد التدريب Top-10 وRareDx-KGPO، الذي يسقط التوقعات في رسم بياني قياسي للأمراض ويكامل الأهمية المصنفة المدققة، وقرب علم التصنيف، والتشابه الطبي الحيوي، واتساق النمط الظاهري.

arxiv arXiv cs.CL · منذ 2 يوم · مشاهدة واحدة

يُطابق Rep2Act تمثيلات نماذج الرؤية واللغة لتحسين الامتناع عن الإجابة على معيار VAD-R الجديد

يقدم الباحثون تشخيص إمكانية الإجابة البصري مع المبررات (VAD-R)، وهو معيار جديد صُمّم لتقييم قدرة نماذج الرؤية واللغة على الامتناع عن الإجابة عن الأسئلة التي لا يمكن الإجابة عليها دون الاعتماد على إشارات مختصرة. تكشف الدراسة أنه بينما يمكن للحالات المخفية التمييز بين إمكانية الإجابة، تفشل النماذج الحالية في ترجمة ذلك إلى قرارات صريحة.

arxiv arXiv cs.CL · منذ 7 يوم · 8 مشاهدات

VHD-Play يولّد بيئات تعلم معزز وكيلي من آليات محلولة

يُعد VHD-Play خط أنشطة يُنتج بيئات متنوعة للتعلم المعزز الوكيل عن طريق أخذ عينات وحل النماذج الرياضية قبل عرض عمليات اتخاذ القرار الخاصة بها كأدوات ذات حالة. يضمن هذا النهج أن الديناميكيات القابلة للتنفيذ ومراجع تقييم المسارات تُورث مباشرة من النموذج المحلول، مما يعالج مشكلات عدم التطابق الشائعة في خطوط الأنظمة الحالية.

arxiv arXiv cs.CL · منذ 7 يوم SWE-Lancer · 51.47% · 10 مشاهدات

تدمج SkillGym المهارات البشرية داخل النماذج اللغوية الكبيرة لحل المشكلات الواقعية

يقدم الباحثون إطار عمل SkillGym، الذي يحول مهارات الوكلاء المكتوبة يدوياً من قبل البشر إلى بيئات تدريب قابلة للتنفيذ وقابلة للتحقق لوكلاء النماذج اللغوية الكبيرة. يستخدم النظام خط أنابيب من المهارة إلى المهمة لتجسيد مهام ملموسة والتحقق من النتائج باستخدام فاحصات مبنية على الكود.

arxiv arXiv cs.AI · منذ 8 يوم · 17 مشاهدة

VideoX-Qwen يقدم إطار عمل يركز على البيانات لتحرير الفيديو القائم على التعليمات

يقدم الباحثون VideoX-Qwen، وهو إطار عمل متكامل يجمع بين بناء البيانات القابلة للتوسع مع تدريب النموذج لتعزيز تحرير الفيديو العام المدعوم بالتعليمات. يستخدم النظام خط أنابيب إنتاج ينظم نماذج متخصصة لتسجيلات التحرير الاتجاهية، مما يؤدي إلى أكثر من 1.2 مليون عينة عالية الجودة في مهام الإضافة والحذف والاستبدال والسمات.

arxiv arXiv cs.CL · منذ 8 يوم · 19 مشاهدة

Qwen تطلق Qwen3.8-Omni-Flash، نموذجًا متعدد الوسائط أصليًا مع سياق مكون من مليون رمز

أعلنت Alibaba Cloud عن إطلاق Qwen3.8-Omni-Flash، وهو نموذج متعدد الوسائط أصليًا مصمم لمهام الإنتاجية في العالم الحقيقي، والذي يحسّن بشكل كبير الفهم والاستدلال متعدد الوسائط مقارنة بالنماذج السابقة.

media r/LocalLLaMA · منذ 9 يوم · 15 مشاهدة

أليبا تخطط لنموذج ذكاء اصطناعي يحتوي على 5 إلى 10 تريليون معلمة وتكشف عن شريحة جديدة

أعلنت أليبا عن خطط لتطوير نموذج ذكاء اصطناعي يحتوي على ما بين 5 إلى 10 تريليون معلمة. وإلى جانب هذا المسار، كشفت الشركة أيضًا عن شريحة مخصصة جديدة مصممة لدعم احتياجات البنية التحتية.

media MarkTechPost · منذ 9 يوم · 22 مشاهدة

ألبابا كوين تطلق نموذج كوين-إيميج 2.1 الموحد بـ 7 مليار معلمة لتوليد وتحرير الصور

أطلقت فريق كوين التابع لألبابا نموذج كوين-إيميج 2.1، وهو نموذج موحد لتوليد الصور من النص وتحريرها، يدمج نقاط التفتيش المنفصلة السابقة في محوّل انتشار واحد بـ 7 مليار معلمة.

media MarkTechPost · منذ 11 يوم · 28 مشاهدة

فريق علي بابا كوين يُصدر Qwen3.8-LiveTranslate ببنية Interleave

أطلق فريق علي بابا كوين نموذج Qwen3.8-LiveTranslate، وهو نموذج ترجمة متزامنة فورية من الجيل التالي يستمع إلى الكلام الحي ويعيد النص المترجم والصوت أثناء استمرار المتحدث في الحديث. يُقدّم هذا الإصدار بنية Interleave جديدة مصممة لتقليل زمن الانتظار وتحسين جودة الترجمة.

lab Hugging Face Blog · منذ 17 يوم · 19 مشاهدة

يتيح TRL v1.14 لـ AsyncGRPOTrainer مزامنة LoRA فقط عبر وظائف Hugging Face

يقدم TRL v1.14 دعمًا لـ LoRA في AsyncGRPOTrainer، مما يتيح له تدريب محوّل Low-Rank Adaptation ومزامنة ذلك الملف الصغير فقط مع عملاء الاستدلال من vLLM. يفصل هذا الهيكل وظائف التدريب عن وظائف التوليد على آلات منفصلة باستخدام Storage Bucket مشترك كجسر لنظام الملفات، مما يلغي الحاجة إلى NCCL أو الاتصال المباشر بالشبكة بين العقد.

media Hugging Face Forums · منذ 17 يوم · 29 مشاهدة

دراسة تحدد "رموزاً هشة" تفشل في نسخ السياق رغم اجتيازها لفحوصات العزل

تصف دراسة "الرموز الهشة" وهي إدخالات مفردات في نماذج لغوية مفتوحة الوزن تنجح في النسخ عند عزلها لكنها تُظهر أخطاءً عند تضمينها في النص المحيط. تسلط الأبحاث الضوء على أن الحفاظ على الهوية الحرفية غير مضمون من خلال اختبارات العزل القياسية، إذ يمكن حذف الرموز أو استبدالها أو اقتطاعها ضمن التسلسلات.

arxiv arXiv cs.AI · منذ 22 يوم SWE-bench Verified · 72.6% · 31 مشاهدة

يستخدم ExecCritic تعزيز التعلم المعتمد على الأدوار لتحسين وكلاء البرمجة عبر الإصلاح الموجه بالاختبارات

يقدم ExecCritic إطار عمل يفصل بين بناء الاختبارات وإصلاح الشفرة المصدرية لمنع الثقة الزائفة في وكلاء البرمجة. يعتمد النظام على وكيل اختبار ووكيل إصلاح، وكلاهما مدعوم بـ Qwen-3.5-35B-A3B، وتم تدريبهما بشكل منفصل باستخدام تعزيز التعلم.

arxiv arXiv cs.CL · منذ 22 يوم SWE-bench Verified · 72.6% · 32 مشاهدة

يستخدم ExecCritic تعزيز التعلم المحدد للدور لتحسين وكلاء البرمجة عبر الإصلاح الموجه بالاختبارات

يقدم الباحثون إطار عمل ExecCritic، الذي يجمع بين هيكل اختبار-تحقق-مراجعة وتعزيز التعلم المحدد للدور لتعزيز وكلاء البرمجة. يفصل النظام بين بناء الاختبار وإصلاح الشفرة المصدرية، باستخدام وكيل اختبار لتوليد اختبارات أصلية للمستودع ووكيل إصلاح لمراجعة الكود استنادًا إلى ملاحظات التنفيذ.