الموضوع · Robotics
lab Google DeepMind Blog · منذ 15 يوم · 9 مشاهدات

جوجل تقدم Gemini Robotics 2 للتحكم في الجسم بالكامل والتعاون بين الروبوتات المتعددة

قدمت جوجل Gemini Robotics 2، وهي طبقة ذكاء مصممة لتزويد الروبوتات القابلة للتكيف بالتحكم الذكي بالجسم بالكامل، والبراعة المتقدمة، والقدرة على التعاون في فرق. يوسع هذا التحديث قدرات الذكاء الاصطناعي المادي بما يتجاوز المهام الضيقة والمتكررة من خلال تمكين الروبوتات من التفكير في الحركات والتكيف بسرعة مع أجسام جديدة.

lab Google DeepMind Blog · منذ 15 يوم · 13 مشاهدة

جوجل تطلق نموذج Gemini Robotics ER 2 مع فهم الفيديو والتعاون متعدد الروبوتات

أطلقت جوجل نموذج Gemini Robotics ER 2، وهو نموذج جديد للاستدلال الجسدي مصمم لمساعدة الروبوتات على التفكير بسرعة وتخطيط المهام متعددة الخطوات في الوقت الفعلي. يقدم التحديث تحسينات كبيرة مقارنةً بالإصدار السابق ER 1.6، بما في ذلك تتبع التقدم المستمر المعتمد على الفيديو، وإيجاد اللحظات الدقيقة، وقدرات التعاون متعدد الروبوتات الأصلية.

lab NVIDIA Research · منذ 9 يوم · 11 مشاهدة

تحسين إنتاجية المصنع بنسبة تصل إلى 12.06 مرة عبر تقديم مجموعة GPU مشتركة باستخدام ROSA

يقترح الباحثون نظام تقديم نماذج أساسية للروبوتات يُدعى ROSA، مصمم لمصانع الروبوتات ويتجاوز افتراضات الحوسبة الطرفية لروبوت واحد. يستخدم النظام تقديم مجموعة GPU المشتركة للسماح لأساطيل الروبوتات بالوصول إلى وحدات معالجة الرسومات من فئة الخوادم عبر الشبكة.

lab Meta AI / FAIR Blog · منذ 18 يوم · 7 مشاهدات

جامعة بيتسبورغ تستخدم نماذج DINOv3 و SAM الخاصة بـ Meta لبناء روبوت مساعد لمشروع ARPA-H الممول

تقود مختبرات أبحاث الهندسة البشرية في جامعة بيتسبورغ (HERL) مشروع منصة التنقل والمناورة المساعدة الروبوتية التي توفر الاستقلالية للأشخاص ذوي الإعاقة (RAMMP)، وهو مشروع مدعوم بتمويل يصل إلى 41.5 مليون دولار من ARPA-H. تهدف المبادرة إلى إنشاء حلول تنقل مساعدة أكثر أمانًا ومرونة لمستخدمي الكراسي المتحركة من خلال دمج الروبوتات المتقدمة مع نماذج الرؤية بالذكاء الاصطناعي مفتوحة المصدر من Meta.

media MarkTechPost · منذ 15 يوم · 4 مشاهدات

جوجل ديب مايند تطلق جيمياني روبوتكس 2 للتحكم الكامل بالجسم والبراعة

أطلقت جوجل ديب مايند جيمياني روبوتكس 2، وهي طبقة ذكاء تتكون من ثلاثة نماذج مصممة لتمكين التحكم الكامل بالجسم، وبراعة الأصابع الخمسة، والتعاون بين الروبوتات المتعددة. تتضمن الإصدار نموذج رؤية-لغة-فعل (VLA)، ونموذج رؤية مجسدية للاستدلال (VLM)، ونموذج VLA يعمل على الجهاز، متجاوزةً بذلك قدرات التلاعب السابقة على الطاولات.

lab Hugging Face Blog · منذ 25 يوم · مشاهدة واحدة

إنفيديا تطلق Cosmos 3 Edge، نموذجًا بـ4 مليارات معلمة للتحكم في الروبوتات في الوقت الفعلي على الأجهزة الطرفية

أطلقت إنفيديا Cosmos 3 Edge، وهو نموذج عالم مفتوح بـ4 مليارات معلمة مصمم لتقديم أداء بمستوى مراكز البيانات على الأنظمة الطرفية ذات الذاكرة المحدودة. يمكّن النموذج الروبوتات ووكلاء الذكاء الاصطناعي للرؤية من فهم محيطهم، والاستدلال في الوقت الفعلي، وتوليد الإجراءات مباشرةً على أجهزة مثل وحدات NVIDIA Jetson.

lab Hugging Face Blog · منذ 1 يوم · 3 مشاهدات

دمج Strands Agents لـ LeRobot و Hugging Face Storage Buckets لحلقات بيانات الروبوت المستمرة

تقدم AWS Strands Agents لتمكين حلقة مستمرة من التسجيل والتدريب ونشر سياسات الروبوت باستخدام مجموعات بيانات LeBucket و Hugging Face Storage Buckets. يتيح هذا التكامل للوكيل مزامنة العروض في دلاء قابلة للتغيير مع إزالة التكرار على مستوى البايت وبث مجموعات البيانات مباشرة من Hub للتدريب دون تنزيل كامل.

media MarkTechPost · منذ 2 يوم · 6 مشاهدات

داينا روبوتكس تطلق داينا-2، نموذج عالمي-فعل مُدرَّب مسبقاً على مليون ساعة من الفيديو البشري

أطلقت داينا روبوتكس نموذج داينا-2، وهو نموذج عالمي-فعل لتلاعب الروبوتات، تم تدريبه مسبقاً على أكثر من مليون ساعة من الفيديو الذاتي المركز للبشر. تُظهر الشركة أن الفيديو البشري العادي يمكن أن يحل محل البيانات المُعلَّمة بالأفعال من خلال وضع قانون قياس يتراوح بين 1,000 و1,000,000 ساعة.

media Hugging Face Forums · منذ 2 يوم · 11 مشاهدة

تكتشف Calibra مشكلات في مجموعات بيانات تعلم الروبوتات

يقدم المؤلف Calibra، وهو مجموعة أدوات مفتوحة المصدر مصممة لتحليل وضمان سلامة مجموعات بيانات تعلم الروبوتات. تهدف الأداة إلى منع إهدار الموارد الحاسوبية من خلال تحديد البيانات المشكوك فيها قبل بدء التدريب.

media Hugging Face Forums · منذ 17 يوم · 3 مشاهدات

Calibra: مجموعة أدوات مفتوحة المصدر لمراقبة مجموعات بيانات الروبوتات

Calibra هي مجموعة أدوات مفتوحة المصدر مصممة لمساعدة الباحثين على تدقيق مجموعات بيانات الروبوتات وتحديد مشكلات الجودة قبل تدريب السياسات. يتضمن الإصدار العام الأول مساحة تفاعلية بعنوان Robot Dataset Health Check لتدقيق مجموعات بيانات LeRobot ومعايرة لـ 30 مجموعة بيانات عامة من LeRobot مع درجات صحية.

lab Hugging Face Blog · منذ 19 يوم · 23 مشاهدة

إنفيديا تطرح Cosmos-H-Dreams، محاكٍ مولّد للوقت الحقيقي للجراحة الروبوتية

أعلنت إنفيديا عن إطلاق Cosmos-H-Dreams، وهو محاكٍ مولّد يعمل في الوقت الفعلي ومشروط بالإجراءات للجراحة الروبوتية، يستخلص قدرات نموذج Cosmos-H-Surgical-Simulator الخاص بها ليحوّلها إلى نموذج طالب سببي. يُقدّم النظام عبر مكتبة إنفيديا FlashDreams المُسرّعة للاستنتاج بالتدفق، مما يتيح التحكم التفاعلي من قبل شخص أو سياسة مُتعلَّمة في حلقة مغلقة.

media Latent Space · منذ 22 يوم · 8 مشاهدات

Black Forest Labs تطلق نماذج التدفق متعددة الوسائط FLUX 3 ونموذج الروبوتات FLUX-mimic

أطلقت Black Forest Labs نموذج FLUX 3، وهو عائلة من نماذج التدفق متعددة الوسائط تتضمن قدرات توليد الفيديو مع الصوت الأصلي. يتضمن الإصدار أيضًا FLUX-mimic، وهو متغير مصمم لتطبيقات الروبوتات الخاصة بحركة الفيديو.

lab Hugging Face Blog · منذ 24 يوم · 8 مشاهدات

نظرة عامة على محركات المحاكاة للذكاء الاصطناعي المادي: MuJoCo وIsaac Sim وNewton

تقدم هذه المقالة نظرة عامة على الحالة الحالية للمحاكاة في مجال الذكاء الاصطناعي المادي، موضحاً كيف تسد المحاكاة الفجوة البياناتية للروبوتات من خلال تمكين بيئات تدريب قابلة للتوسع وذات واقعية بصرية عالية. وتحدد المقال نموذجاً يعتمد على ثلاثة حواسيب (التدريب، والمحاكاة، وعلى الروبوت)، وتصنف محركات المحاكاة الرئيسية بناءً على قدراتها المحددة وحالات الاستخدام الخاصة بها.

media MarkTechPost · منذ 24 يوم · 6 مشاهدات

إنفيديا تطلق كوزموس 3 إيدج، نموذج عالم مفتوح بحجم 4 مليارات معلمة لاستدلال الروبوتات على الجهاز

أطلقت إنفيديا نموذج كوزموس 3 إيدج، وهو نموذج عالم مفتوح يتكون من 4 مليارات معلمة مصمم للعمل على الجهاز للروبوتات ووكلاء الذكاء الاصطناعي للرؤية. أُصدر في 20 يوليو على منصة Hugging Face، مما يتيح للنظم فهم المحيط والاستدلال في الوقت الفعلي وتوليد إجراءات الروبوت محليًا دون الاعتماد على السحابة.

lab Hugging Face Blog · منذ 25 يوم · مشاهدتان

بولين روبوتكس تطلق غرابيت، نظام مفتوح منخفض التكلفة لتسجيل بيانات المناورة الروبوتية

أطلقت بولين روبوتكس (Pollen Robotics) جهاز غرابيت (Grabette)، وهو جهاز محمول مفتوح المصدر مصمم لتسجيل بيانات المناورة الروبوتية في العالم الحقيقي دون الحاجة إلى روبوت أو معدات للتحكم عن بعد. يستخدم النظام كاميرا عين السمكة وكاميرا عمق RGBD لالتقاط مسارات ذات 6 درجات من الحرية، مما يتيح للمستخدمين إنشاء مجموعات بيانات نظيفة يمكن معالجتها عبر لوحة تحكم تعمل على المتصفح ومشاركتها على Hugging Face Hub.

arxiv arXiv cs.LG · منذ 29 يوم · مشاهدتان

يوسع RoboTTT سياسات الروبوت إلى سياق من 8 آلاف خطوة زمنية

يقدم الباحثون RoboTTT، وهي وصفة تدريب تمدد السياق البصري-حركي لنماذج الروبوت الأساسية إلى 8,000 خطوة زمنية دون زيادة زمن الاستدلال. تدمج الطريقة التدريب في وقت الاختبار في سياسات الرؤية-اللغة-الإجراء باستخدام أوزان سريعة يتم تحديثها عبر النزول التدرجي أثناء كل من التدريب والاستدلال.

arxiv arXiv cs.AI · منذ 29 يوم

يوسع RoboTTT سياسات الروبوت إلى سياق من 8 آلاف خطوة زمنية

تُقدم إنفيديا نموذج RoboTTT، وهو نموذج أساسي للروبوتات وصفة تدريب تمدد السياق الحسي-حركي إلى 8000 خطوة زمنية دون زيادة زمن الاستدلال. من خلال دمج التدريب أثناء الاختبار في سياسات الرؤية-اللغة-الإجراء، يضغط النظام التاريخ إلى فضاء الأوزان باستخدام أوزان سريعة تُحدَّث عن طريق النزول التدرجي.