المصدر · arXiv cs.LG
arxiv arXiv cs.LG · منذ 18 يوم · 3 مشاهدات

مونشوت آي إيه تطلق كيمي K3، نموذج MoE بـ 2.8 تريليون معلمة وسياق بمليون رمز

أعلنت مونشوت آي إيه عن إطلاق كيمي K3، وهو نموذج مزيج الخبراء مفتوح المصدر يتميز بـ 2.8 تريليون معلمة إجمالاً و104 مليار معلمة مُفعّلة لكل رمز. يدعم النموذج قدرات الرؤية الأصلية ونافذة سياق تتكون من مليون رمز، مستفيداً من انتباه كيمي دلتا ومزيج الخبراء المستقر في المتغيرات الخفية لتحقيق كفاءة توسع تقارب 2.5 مرة مقارنة بسلفه كيمي K2.

arxiv arXiv cs.LG · منذ 19 ساعة · مشاهدة واحدة

Faraday 27B يتفوق على Claude Opus 4.8 و GPT-5.5 في مهام إعادة إنتاج الأوراق البحثية

طور الباحثون Replica، مساحة مهام قابلة للتوسع لإعادة إنتاج الأوراق البحثية، لمعالجة الحاجة إلى معرفة علمية موثوقة. قاموا بإجراء تدريب لاحق لـ Faraday، وهو وكيل "AI Scientist" بـ 27 مليار معلمة يستخدم وكلاء البرمجة كأدوات، للاستفادة من هذا البيئة.

arxiv arXiv cs.LG · منذ 20 ساعة · 3 مشاهدات

Intern-S2-Preview: نموذج أساسي علمي ذو وكيل

يقدم المؤلفون Intern-S2-Preview، وهو سلسلة من النماذج الأساسية العلمية ذات الوكلاء مصممة لدعم الفهم متعدد الوسائط العلمي، والاستدلال، والتوليد، والمهام طويلة المدى. تبدأ خط أنابيب التدريب بالتدريب المسبق متعدد الوسائط العلمي على المستندات العلمية المُصاغة، والبيانات المتداخلة للصور والنصوص، ومجموعات البيانات العلمية المتنوعة.

arxiv arXiv cs.LG · منذ 2 يوم HealthBench · 51.9% · 5 مشاهدات

نظام VITA للرAG السريري يساوي أو يتفوق على نماذج LLM المتقدمة في HealthBench

تم تقييم نظام توليد معزز بالاسترجاع (RAG) المصمم خصيصًا والمسمى VITA، والمخصص للبيئات منخفضة ومتوسطة الدخل، مقابل نماذج لغوية كبيرة لأغراض عامة على معيار HealthBench. من بين 4023 سؤالًا تم تقييمها بواسطة حكم GPT-4.1، احتل VITA المرتبة الأولى بنسبة 51.9% من نقاط المعايير الممكنة، متفوقًا على GPT-5.4 و o4-mini و Gemini 3.1 Pro و Claude Sonnet 4.6.

arxiv arXiv cs.LG · منذ 4 يوم · مشاهدتان

Macaron-V1 يُطلق عائلة نماذج وكلاء مفتوحة المصدر باستخدام Mixture-of-LoRA للتعلم المستمر

يُعد Macaron-V1 عائلة نماذج وكلاء مفتوحة المصدر مصممة للذكاء التجريبي، مما يتيح التعلم من البيئات الحقيقية والاستمرار في التعلم بعد النشر. يركز النظام على هدفين: التكيف من خلال التحسين المتكرر لأزواج النموذج-المقصودة، والتعاون عبر بنية Mixture-of-LoRA (MoL) التي تختار محولات LoRA المتخصصة لكل دور للمستخدم.

arxiv arXiv cs.LG · منذ 4 يوم · 11 مشاهدة

باحثون يستغلون إعادة استخدام التشفير عبر الجلسات لسحب مسارات الاستدلال من واجهات برمجة تطبيقات نماذج اللغة الكبيرة

حدد الباحثون ثغرة في كيفية تعامل مقدمي نماذج اللغة الكبيرة الرائد مع مسارات الاستدلال خطوة بخطوة، والتي تُرجع ككتل مشفرة للاستخدام من جانب العميل. وجدوا أن هذه الكتل المشفرة متوافقة تمامًا وقابلة للتبديل عبر جلسات مختلفة ومستخدمين ونماذج داخل نظام بيئي لنفس المزود.

arxiv arXiv cs.LG · منذ 8 يوم

يُمكّن U-OPSD التنقيح الذاتي غير الخاضع للإشراف في السياسة الحالية لنماذج اللغات الكبيرة

يقترح الباحثون التنقيح الذاتي غير الخاضع للإشراف في السياسة الحالية (U-OPSD)، وهي طريقة تحقق تحسينًا ما بعد التدريب لنماذج اللغات الكبيرة باستخدام توليدات النموذج الخاصة به فقط دون إشراف خارجي. تعتمد الطريقة على أخذ عينات من عدة مسارات لبناء حل شبه صحيح عبر التصويت بالأغلبية، ثم تنقيح توزيع المعلم إلى بادئات أطول إكمال خاطئ للنموذج.

arxiv arXiv cs.LG · منذ 11 يوم OSWorld 2.0 · 21.2% · 20 مشاهدة

كيون تطلق كيون-سيوا، وكيل استخدام الحاسوب الأصلي ذو 397B-A17B

تقدم كيون كيون-سيوا، وهو وكيل استخدام حاسوب أصلي مبني على هيكل مزيج الخبراء بـ 397B-A17B يعمل عبر لقطات الشاشة وأحداث الإدخال دون الاعتماد على أشجار DOM أو البيانات الوصفية لإمكانية الوصول. يستخدم النظام دعامة للحفاظ على ما يصل إلى 20 لقطة شاشة نشطة وتم تدريبه باستخدام أسطول نشر سحابي يضم ما يقرب من 100,000 وحدة معالجة افتراضية عبر حوالي 40,000 مهمة قابلة للتحقق.

arxiv arXiv cs.LG · منذ 24 يوم · 8 مشاهدات

يستخدم SkewAdam حالة محسّن متعددة الطبقات لتقليل ذاكرة تدريب MoE بنسبة 97%

يطرح الباحثون SkewAdam، وهو محسّن مصمم لنماذج مزيج الخبراء (MoE)، يخصص أنواعًا مختلفة من الحالة لمجموعات بارامترية مميزة لتقليل استخدام الذاكرة بشكل كبير. ومن خلال تعيين زخم float32 ولحظات ثانية مُعامَلة للعمود الفقري، ولحظات ثانية مُعامَلة للخبراء، ولحظات ثانية دقيقة للموجّه، يقلل SkewAdam حالة المحسّن من 50.6 جيجابايت إلى 1.29 جيجابايت لنموذج ذي 6.78 مليار معلمة.

arxiv arXiv cs.LG · منذ 29 يوم · مشاهدتان

يوسع RoboTTT سياسات الروبوت إلى سياق من 8 آلاف خطوة زمنية

يقدم الباحثون RoboTTT، وهي وصفة تدريب تمدد السياق البصري-حركي لنماذج الروبوت الأساسية إلى 8,000 خطوة زمنية دون زيادة زمن الاستدلال. تدمج الطريقة التدريب في وقت الاختبار في سياسات الرؤية-اللغة-الإجراء باستخدام أوزان سريعة يتم تحديثها عبر النزول التدرجي أثناء كل من التدريب والاستدلال.