Open weights
media TLDR AI · منذ 2 ساعة · 10 مشاهدات

شاومي تطلق نماذج MiMo-V2.6 Pro و Flash كمصدر مفتوح

أطلقت شاومي نماذج omnimodal الخاصة بها MiMo-V2.6 Pro و Flash كمصدر مفتوح، وهي مصممة لتنسيق الوكلاء لبناء واختبار مشاهد ثلاثية الأبعاد تفاعليًا بصريًا. يمكن لهذه النماذج توليد أصول Blender، والتحكم في أذرع الروبوت من تدفقات الكاميرا، وإنشاء واجهات أمامية وعروض تقديمية، وتجميع مقاطع الفيديو، وتأليف الموسيقى كنوتات موسيقية و MIDI.

media Latent Space · منذ 22 ساعة · 11 مشاهدة

شاومي تطلق MiMo-V2.6-Pro، نموذجًا متعدد الوسائط مفتوح الأوزان من الطراز الأول تم تدريبه بتكلفة 3 ملايين دولار

أطلقت شاومي سلسلة MiMo-V2.6، مقدمةً نماذج متعددة الوسائط بشكل أصلي تشمل MiMo-V2.6-Pro وMiMo-V2.6-Flash. كما أطلقت الشركة MiMo-V2.6-Pro-UltraSpeed، الذي يوفر سرعة إخراج أسرع بـ 20 مرة بنفس الجودة.

media MarkTechPost · منذ 1 يوم Terminal-Bench 2 · 69.7% · 9 مشاهدات

إطلاق AWS Strands Agents لإطار عمل Strands Harness مفتوح المصدر بتكلفة رموز أقل

أطلق فريق AWS Strands Agents إطار عمل Strands Harness، وهو إطار عمل عام للأجلة مفتوح المصدر متاح بموجب رخصة Apache 2.0 لكل من Python وTypeScript. صُمم الأداة لسد الفجوة بين تجريب الأجلة في بيئات مثل Claude Code أو Codex ونشرها مع حلقات مخصصة.

lab Microsoft Research Blog · منذ 2 يوم · 29 مشاهدة

مايكروسوفت تطلق RetroChimera للتنبؤ بالتخليق العكسي

نشرت مايكروسوفت ريسيرش وأصدرت كود RetroChimera كمصدر مفتوح، وهو إطار عمل جديد للتنبؤ بالتخليق العكسي يدمج نموذجين متكاملين لاقتراح مسارات تخليق عالية الجودة. يدمج النظام R-SMILES 2، وهو نموذج من نوع Transformer مُنشأ من الصفر، مع NeuralLoc، وهو نموذج قائم على الشبكات العصبية البيانية (GNN)، باستخدام استراتيجية تجميع مُتعلَّمة لترتيب التنبؤات.

media MarkTechPost · منذ 2 يوم · 14 مشاهدة

ألبابا كوين تطلق نموذج كوين-إيميج 2.1 الموحد بـ 7 مليار معلمة لتوليد وتحرير الصور

أطلقت فريق كوين التابع لألبابا نموذج كوين-إيميج 2.1، وهو نموذج موحد لتوليد الصور من النص وتحريرها، يدمج نقاط التفتيش المنفصلة السابقة في محوّل انتشار واحد بـ 7 مليار معلمة.

lab Hugging Face Blog · منذ 2 يوم · 10 مشاهدات

مرشح الإصدار التجريبي من مكتبة tokenizers v1 يقدم تسريعاً في الترميز بمعدل 3-30 مرات عبر تقسيم تدفق البتات والتخزين المؤقت

أصدرت مكتبة tokenizers مرشح إصدار تجريبي للإصدار الأول يحسّن بشكل كبير أداء ترميز النصوص، مما يعالج الاختناقات في سير عمل التدريب والتقديم. يحافظ التحديث على توافق واجهة برمجة التطبيقات مع الإصدار v0.23 بينما يقدم تسريعات كبيرة عبر عشر عائلات من النماذج.

lab Hugging Face Blog · منذ 2 يوم MMLU · 77.0% · 15 مشاهدة

تعيد Multiverse صياغة إزالة كتل نماذج اللغات الكبيرة كمشكلة تحسين إيزينغ للضغط العميق

أصدرت Multiverse ورقةً تفصّل منهجاً يعيد صياغة تقليم نماذج اللغات الكبيرة كمشكلة تحسين ثنائية مقيدة مُخاطبة إلى زجاج إيزينغ. ومن خلال معاملة كتل المحوّل على أنها لفّات ذات اقترانات زوجية مُشتقة من هيسيان الخسارة، يحدد هذا النهج تكوينات الإزالة المثلى للكتل دون الحاجة إلى معايرة تكرارية.

media Interconnects · منذ 2 يوم Artificial Analysis Intelligence Index · 45.0% · 17 مشاهدة

تتفوق النماذج الصينية مفتوحة الأوزان على نظيرتها الأمريكية في التنزيلات والمعايير

يقدم المؤلف موجزًا عن حالة النماذج مفتوحة الأوزان، موضحًا أن الشركات الصينية للذكاء الاصطناعي أصبحت القادة الواضحون في هذا المجال منذ حوالي أبريل 2025. ويتجلى هذا التحول من خلال مقاييس التنزيل على Hugging Face والأداء في معايير القدرات.

media r/LocalLLaMA · منذ 5 يوم · 36 مشاهدة

إينكلوجن AI تطلق Realtime-Venus، نموذج تفاعل صوتي بصري بحجم 9B

أطلقت إينكلوجن AI نظام Realtime-Venus على منصة Hugging Face، والذي يتضمن نقطتي فحص: Realtime-Venus-Omni وRealtime-Venus-Audio. يُعد نقطة Omni نموذج تفاعل صوتي بصري بحجم 9B مُعدّل من MiniCPM-o 4.5، يراقب ويستمع باستمرار ليقرر متى يستجيب.

media r/LocalLLaMA · منذ 5 يوم · 17 مشاهدة

Naive AI تُقيّم بمليار و400 مليون دولار، تخطط لإصدار نموذج لغوي كبير بوزن مفتوح

أكملت Naive AI، وهي شركة ناشئة تعمل في الخفاء أسسها البروفيسور داي جيفينغ من جامعة تسينغهوا، ثلاث جولات من التمويل totaling 400 مليون دولار، مما وصل بتقييمها إلى أكثر من 1.4 مليار دولار. تستعد الشركة لإطلاق نموذجها اللغوي الكبير الأول، المسمى أيضًا Naive، كإصدار بوزن مفتوح في أقرب وقت هذا الشهر.

lab Tencent Hunyuan (HF) · منذ 6 يوم · 64 مشاهدة

تيانتينغ تطلق WeVisDoc-4B، محلل مستندات من البداية للنهاية

أطلقت تيانتينغ WeVisDoc-4B، وهو محلل مستندات من البداية للنهاية لصور الصفحات يحول الصفحات إلى Markdown هيكلي مع صيغ LaTeX وجداول HTML. تم ضبطه بدقة من Qwen3-VL-4B-Instruct، حقق النموذج درجة إجمالية تبلغ 95.38 على OmniDocBench v1.6 ويتصدر المراكز بين محللات المستندات المقارنة في جميع الإعدادات الأربعة المذكورة.

media Together AI Blog · منذ 7 يوم · 16 مشاهدة

توضيح استراتيجية الانتقال من النماذج المغلقة إلى نماذج المصدر المفتوح

توفر Together إطار عمل للشركات للانتقال من نماذج الذكاء الاصطناعي ذات المصدر المغلق إلى نماذج المصدر المفتوح (OSM) باستخدام الخدمات المُدارة، بهدف تقليل التعقيد وتسريع الاعتماد. تتضمن العملية اكتشاف النماذج المناسبة عبر المعايير، وتقييمها من خلال إعادة تشغيل حركة المرور، وتعديل المطالبات أو الأوزان، وحساب العائد على الاستثمار لتبرير التغيير.

media r/LocalLLaMA · منذ 7 يوم · 18 مشاهدة

تقرير موزيلادعوى أن نماذج الذكاء الاصطناعي ذات الأوزان المفتوحة في الصين متأخرة بشهرين عن عروض الواجهة الأمريكية

يشير تقرير من موزيلا إلى أن نماذج الذكاء الاصطناعي ذات الأوزان المفتوحة في الصين قد أغلقت فجوة التطوير لتصبح فقط أربعة أشهر خلف العروض الواجهة الأمريكية. على الرغم من هذا التقدم السريع، لا تزال النماذج تتأخر في بعض تقييمات المعايير.