أليبا تعلن عن Qwen 4 في مؤتمر أبسارا
أعلنت أليبا رسمياً عن إصدار Qwen 4 خلال مؤتمر أبسارا.
أعلنت أليبا رسمياً عن إصدار Qwen 4 خلال مؤتمر أبسارا.
أطلقت فريق Qwen التابع لشركة أليبا الإصدار Qwen3.8-Omni-Flash، وهو أول نموذج متعدد الوسائط مصمم حول القدرات الذاتية للاستخدام في فهم الصوت والفيديو واستخدام الأدوات. يقبل النموذج مدخلات نصية وصورًا وصوتًا وفيديو لإرجاع مخرجات نصية، ويتميز بنافذة سياق تتسع لـ 1 مليون رمز ودعم استدعاء الوظائف بشكل أصلي.
أطلقت فريق كوين التابع لألبابا مجموعة نماذج صوتية مكونة من خمسة نماذج، تشمل Qwen-Audio-3.1-Realtime-plus الجديد، وهو نموذج كلام ثنائي الاتجاه مصمم لوكلاء الصوت القادرين على الاستدلال واستخدام الأدوات. كما يتضمن الإطلاق تخفيضات في الأسعار تصل إلى 95% على خدمات التعرف التلقائي على الكلام (ASR).
أصدر مختبر خوارزميات ISTA العميق والأنظمة إصدارات GGUF المُكمّاة للنموذج ذو الخبراء المتناثرين Qwen3.8-Flash-Next، جنباً إلى جنب مع بناء تجريبي مستهدف القدرات تمت إزالة نصف خبراءه.
يقدم المؤلفون نظام RareDx، الذي يربط بين الاستخدام الخاضع للرقابة للأدلة وتحسين السياسة المستندة إلى رسم بياني للمعرفة لمعالجة مشكلة الاستدلال ذي الذيل الطويل في تشخيص الأمراض النادرة. يجمع خط التدريب بين ما بعد التدريب Top-10 وRareDx-KGPO، الذي يسقط التوقعات في رسم بياني قياسي للأمراض ويكامل الأهمية المصنفة المدققة، وقرب علم التصنيف، والتشابه الطبي الحيوي، واتساق النمط الظاهري.
يقدم الباحثون تشخيص إمكانية الإجابة البصري مع المبررات (VAD-R)، وهو معيار جديد صُمّم لتقييم قدرة نماذج الرؤية واللغة على الامتناع عن الإجابة عن الأسئلة التي لا يمكن الإجابة عليها دون الاعتماد على إشارات مختصرة. تكشف الدراسة أنه بينما يمكن للحالات المخفية التمييز بين إمكانية الإجابة، تفشل النماذج الحالية في ترجمة ذلك إلى قرارات صريحة.
يُعد VHD-Play خط أنشطة يُنتج بيئات متنوعة للتعلم المعزز الوكيل عن طريق أخذ عينات وحل النماذج الرياضية قبل عرض عمليات اتخاذ القرار الخاصة بها كأدوات ذات حالة. يضمن هذا النهج أن الديناميكيات القابلة للتنفيذ ومراجع تقييم المسارات تُورث مباشرة من النموذج المحلول، مما يعالج مشكلات عدم التطابق الشائعة في خطوط الأنظمة الحالية.
يقدم الباحثون إطار عمل SkillGym، الذي يحول مهارات الوكلاء المكتوبة يدوياً من قبل البشر إلى بيئات تدريب قابلة للتنفيذ وقابلة للتحقق لوكلاء النماذج اللغوية الكبيرة. يستخدم النظام خط أنابيب من المهارة إلى المهمة لتجسيد مهام ملموسة والتحقق من النتائج باستخدام فاحصات مبنية على الكود.
يقدم الباحثون VideoX-Qwen، وهو إطار عمل متكامل يجمع بين بناء البيانات القابلة للتوسع مع تدريب النموذج لتعزيز تحرير الفيديو العام المدعوم بالتعليمات. يستخدم النظام خط أنابيب إنتاج ينظم نماذج متخصصة لتسجيلات التحرير الاتجاهية، مما يؤدي إلى أكثر من 1.2 مليون عينة عالية الجودة في مهام الإضافة والحذف والاستبدال والسمات.
أعلنت Alibaba Cloud عن إطلاق Qwen3.8-Omni-Flash، وهو نموذج متعدد الوسائط أصليًا مصمم لمهام الإنتاجية في العالم الحقيقي، والذي يحسّن بشكل كبير الفهم والاستدلال متعدد الوسائط مقارنة بالنماذج السابقة.
أعلنت أليبا عن خطط لتطوير نموذج ذكاء اصطناعي يحتوي على ما بين 5 إلى 10 تريليون معلمة. وإلى جانب هذا المسار، كشفت الشركة أيضًا عن شريحة مخصصة جديدة مصممة لدعم احتياجات البنية التحتية.
أطلقت فريق كوين التابع لألبابا نموذج كوين-إيميج 2.1، وهو نموذج موحد لتوليد الصور من النص وتحريرها، يدمج نقاط التفتيش المنفصلة السابقة في محوّل انتشار واحد بـ 7 مليار معلمة.
أطلقت Qwen نموذج Qwen-Image-2.1، وهو نموذج موحد مصمم لكل من توليد الصور وتحريرها.
أطلق فريق علي بابا كوين نموذج Qwen3.8-LiveTranslate، وهو نموذج ترجمة متزامنة فورية من الجيل التالي يستمع إلى الكلام الحي ويعيد النص المترجم والصوت أثناء استمرار المتحدث في الحديث. يُقدّم هذا الإصدار بنية Interleave جديدة مصممة لتقليل زمن الانتظار وتحسين جودة الترجمة.
أطلقت أليبا نموذج ذكاء اصطناعي طبي مفتوح المصدر قادر على اكتشاف السرطان وما يقرب من 150 حالة طبية أخرى.
حقق نموذج Qwen3.8 Max (0902) درجة 45 في مؤشر الذكاء الاصطناعي من Artificial Analysis، مستعيداً الصدارة على القائمة الصينية.
يقدم TRL v1.14 دعمًا لـ LoRA في AsyncGRPOTrainer، مما يتيح له تدريب محوّل Low-Rank Adaptation ومزامنة ذلك الملف الصغير فقط مع عملاء الاستدلال من vLLM. يفصل هذا الهيكل وظائف التدريب عن وظائف التوليد على آلات منفصلة باستخدام Storage Bucket مشترك كجسر لنظام الملفات، مما يلغي الحاجة إلى NCCL أو الاتصال المباشر بالشبكة بين العقد.
تصف دراسة "الرموز الهشة" وهي إدخالات مفردات في نماذج لغوية مفتوحة الوزن تنجح في النسخ عند عزلها لكنها تُظهر أخطاءً عند تضمينها في النص المحيط. تسلط الأبحاث الضوء على أن الحفاظ على الهوية الحرفية غير مضمون من خلال اختبارات العزل القياسية، إذ يمكن حذف الرموز أو استبدالها أو اقتطاعها ضمن التسلسلات.
يقدم ExecCritic إطار عمل يفصل بين بناء الاختبارات وإصلاح الشفرة المصدرية لمنع الثقة الزائفة في وكلاء البرمجة. يعتمد النظام على وكيل اختبار ووكيل إصلاح، وكلاهما مدعوم بـ Qwen-3.5-35B-A3B، وتم تدريبهما بشكل منفصل باستخدام تعزيز التعلم.
يقدم الباحثون إطار عمل ExecCritic، الذي يجمع بين هيكل اختبار-تحقق-مراجعة وتعزيز التعلم المحدد للدور لتعزيز وكلاء البرمجة. يفصل النظام بين بناء الاختبار وإصلاح الشفرة المصدرية، باستخدام وكيل اختبار لتوليد اختبارات أصلية للمستودع ووكيل إصلاح لمراجعة الكود استنادًا إلى ملاحظات التنفيذ.