المختبر · DeepSeek
lab DeepSeek API Docs · منذ 21 يوم Codeforces (Elo) · 3471.0Elo · 67 مشاهدة

ديب سيك تطلق نموذج V4.1-Flash بدعم متعدد الوسائط الأصلي

أطلقت ديب سيك رسميًا نموذج DeepSeek-V4.1-Flash، والذي يعتبر أصغر عضو في عائلة المعماريات الجديدة ويتميز بالفهم البصري متعدد الوسائط الأصلي. تم تصميم هذه المعمارية الجديدة لتقديم سقف قدرة أعلى، وسرعات استنتاج أسرع، وإنتاجية أعلى، وإمكانية توسع أفضل للنماذج الأكبر.

media AI News (smol.ai) · منذ 18 يوم · 51 مشاهدة

ديب سيك تطلق V4.1-Flash، نموذج ذو أوزان مفتوحة يركز على كفاءة الاستنتاج القصوى

أطلقت ديب سيك V4.1-Flash، وهو نموذج رائد جديد ذو أوزان مفتوحة مصمم لكفاءة استنتاج قصوى وتكلفة منخفضة. يستخدم النموذج بنية مشفر-مفكك سببية لتقليل الحساب النشط وتكاليف KV/الذاكرة المؤقتة بشكل كبير.

media MarkTechPost · منذ 20 يوم · 55 مشاهدة

ديب سيك تطلق DeepSeek-V4.1-Flash بسياق من 1 مليون وتخزين مؤقت KV بدقة FP4

أعلنت ديب سيك أيه آي عن إطلاق DeepSeek-V4.1-Flash، وهو نموذج مختلط الخبراء متعدد الوسائط يتميز بنافذة سياق تتكون من مليون رمز وتخزين مؤقت KV بدقة FP4 يقلل من حجم التخزين المؤكي العالمي إلى 890 بايت لكل رمز. يعتمد النموذج على بنية مشفر-مفكك سببية وCompressed Sparse Attention 2 (CSA2) لخفض متطلبات الذاكرة بشكل كبير مع الحفاظ على الأداء.

media r/LocalLLaMA · منذ 8 يوم · 13 مشاهدة

ديب سيك ومونشوت آي تواجهان تحقيقاً في بكين بسبب تسرب محتمل للبيانات إلى أنثروبيك

تقوم الجهات التنظيمية الصينية بتحقيق في ديب سيك ومونشوت آي بشأن التسرب المحتمل للبيانات إلى الشركة الأمريكية أنثروبيك. يأتي التحقيق بعد شائعات تتعلق بمديرين تنفيذيين من كيمي، على الرغم من أن الوضع يُوصف حالياً بأنه تحقيق وليس اعتقالات مؤكدة.

arxiv arXiv cs.AI · منذ 10 يوم · 24 مشاهدة

CodeMidas يوسع بيئات التعلم بالتعزيز للبرمجة الوكيلية باستخدام الكود المصدري

يقدم الباحثون CodeMidas، وهو خط أنابيب وكيلي يبني بيئات التعلم بالتعزيز من الوظائف المُنفذة في مستودعات الكود المصدري مفتوح المصدر، باستخدام الكود المصدري كإدخال وحيد. تقوم الطريقة بتخصيص الحوسبة الوكيلية لاستكشاف الوظائف، وبناء اختبارات مبنية على التنفيذ، والتحقق من صحة المهام عبر عمليات تشغيل متكررة، مما يؤدي إلى مجموعة بيانات تحتوي على 5,545 مهمة تدريب عبر 23 لغة برمجة. يؤدي تدريب MiMo-V2.5 على هذه المهام باستخدام GRPO إلى تحسين الأداء في خمسة معايير متنوعة، بما في ذلك DeepSWE (+11.7%) وProgramBench (+17%) وTerminal-Bench v2.1 (+8.5%). يشير تحليل المسارات إلى أن الوكيل المدرب بالتعلم بالتعزيز يظهر سلوكيات أفضل مثل زيادة استكشاف قاعدة الكود وتنوع أكبر في التحقق الذاتي. تؤسس هذه النتائج الكود المصدري كأساس قابل للتوسع لبناء بيئات التعلم بالتعزيز التي تحسن وكلاء البرمجة عبر مهام برمجية متنوعة.

arxiv arXiv cs.AI · منذ 15 يوم · 27 مشاهدة

معاينة Atria Dawn: نموذج لغوي أساسي ذو قدرات وكيلة لأبحاث العلوم

يُعد Atria Dawn Preview نموذجًا لغويًا أساسيًا ذا قدرات وكيلة، صُمم لعمليات البحث العلمي وأعمال الهندسة، وتم تدريبه عبر خط أنابيب لتجارب قابلة للتحقق يربط التفاعلات الوسيطة بالأدوات بالبيئات القابلة للتنفيذ. وعلى مدار 16 معيارًا تغطي البحث الحقيقي، والهندسة، والعمل الرقمي، يتنافس النموذج مع الوكلاء المتقدمة ويحقق أعلى درجة مُبلغ عنها في خمسة منها.

media r/LocalLLaMA · منذ 21 يوم · 56 مشاهدة

ديب سيك تطلق V4.1 فلاش، نموذج MoE بحجم 552B بتكلفة أقل وسرعة أعلى

أطلقت ديب سيك رسميًا نموذج DeepSeek V4.1 Flash، وهو أصغر عضو في سلسلة معماريتها الجديدة التي تتميز بالفهم البصري متعدد الوسائط الأصلي. مبني على تصميم Causal-Encoder-Decoder، فهو نموذج Mixture of Experts (MoE) بـ 552B معامل، ينشط فقط 8B معامل من جانب الإدخال و16B من جانب الإخراج.