Robotics
lab NVIDIA Research · منذ 3 يوم · 5 مشاهدات

تحسين إنتاجية المصنع بنسبة تصل إلى 12.06 مرة عبر تقديم مجموعة GPU مشتركة باستخدام ROSA

يقترح الباحثون نظام تقديم نماذج أساسية للروبوتات يُدعى ROSA، مصمم لمصانع الروبوتات ويتجاوز افتراضات الحوسبة الطرفية لروبوت واحد. يستخدم النظام تقديم مجموعة GPU المشتركة للسماح لأساطيل الروبوتات بالوصول إلى وحدات معالجة الرسومات من فئة الخوادم عبر الشبكة.

media MarkTechPost · منذ 9 يوم · مشاهدتان

جوجل ديب مايند تطلق جيمياني روبوتكس 2 للتحكم الكامل بالجسم والبراعة

أطلقت جوجل ديب مايند جيمياني روبوتكس 2، وهي طبقة ذكاء تتكون من ثلاثة نماذج مصممة لتمكين التحكم الكامل بالجسم، وبراعة الأصابع الخمسة، والتعاون بين الروبوتات المتعددة. تتضمن الإصدار نموذج رؤية-لغة-فعل (VLA)، ونموذج رؤية مجسدية للاستدلال (VLM)، ونموذج VLA يعمل على الجهاز، متجاوزةً بذلك قدرات التلاعب السابقة على الطاولات.

lab Google DeepMind Blog · منذ 10 يوم · 4 مشاهدات

جوجل تقدم Gemini Robotics 2 للتحكم في الجسم بالكامل والتعاون بين الروبوتات المتعددة

قدمت جوجل Gemini Robotics 2، وهي طبقة ذكاء مصممة لتزويد الروبوتات القابلة للتكيف بالتحكم الذكي بالجسم بالكامل، والبراعة المتقدمة، والقدرة على التعاون في فرق. يوسع هذا التحديث قدرات الذكاء الاصطناعي المادي بما يتجاوز المهام الضيقة والمتكررة من خلال تمكين الروبوتات من التفكير في الحركات والتكيف بسرعة مع أجسام جديدة.

lab Google DeepMind Blog · منذ 10 يوم · 9 مشاهدات

جوجل تطلق نموذج Gemini Robotics ER 2 مع فهم الفيديو والتعاون متعدد الروبوتات

أطلقت جوجل نموذج Gemini Robotics ER 2، وهو نموذج جديد للاستدلال الجسدي مصمم لمساعدة الروبوتات على التفكير بسرعة وتخطيط المهام متعددة الخطوات في الوقت الفعلي. يقدم التحديث تحسينات كبيرة مقارنةً بالإصدار السابق ER 1.6، بما في ذلك تتبع التقدم المستمر المعتمد على الفيديو، وإيجاد اللحظات الدقيقة، وقدرات التعاون متعدد الروبوتات الأصلية.

media Hugging Face Forums · منذ 12 يوم · مشاهدتان

Calibra: مجموعة أدوات مفتوحة المصدر لمراقبة مجموعات بيانات الروبوتات

Calibra هي مجموعة أدوات مفتوحة المصدر مصممة لمساعدة الباحثين على تدقيق مجموعات بيانات الروبوتات وتحديد مشكلات الجودة قبل تدريب السياسات. يتضمن الإصدار العام الأول مساحة تفاعلية بعنوان Robot Dataset Health Check لتدقيق مجموعات بيانات LeRobot ومعايرة لـ 30 مجموعة بيانات عامة من LeRobot مع درجات صحية.

lab Meta AI / FAIR Blog · منذ 13 يوم · 3 مشاهدات

جامعة بيتسبورغ تستخدم نماذج DINOv3 و SAM الخاصة بـ Meta لبناء روبوت مساعد لمشروع ARPA-H الممول

تقود مختبرات أبحاث الهندسة البشرية في جامعة بيتسبورغ (HERL) مشروع منصة التنقل والمناورة المساعدة الروبوتية التي توفر الاستقلالية للأشخاص ذوي الإعاقة (RAMMP)، وهو مشروع مدعوم بتمويل يصل إلى 41.5 مليون دولار من ARPA-H. تهدف المبادرة إلى إنشاء حلول تنقل مساعدة أكثر أمانًا ومرونة لمستخدمي الكراسي المتحركة من خلال دمج الروبوتات المتقدمة مع نماذج الرؤية بالذكاء الاصطناعي مفتوحة المصدر من Meta.

lab Hugging Face Blog · منذ 13 يوم · 19 مشاهدة

إنفيديا تطرح Cosmos-H-Dreams، محاكٍ مولّد للوقت الحقيقي للجراحة الروبوتية

أعلنت إنفيديا عن إطلاق Cosmos-H-Dreams، وهو محاكٍ مولّد يعمل في الوقت الفعلي ومشروط بالإجراءات للجراحة الروبوتية، يستخلص قدرات نموذج Cosmos-H-Surgical-Simulator الخاص بها ليحوّلها إلى نموذج طالب سببي. يُقدّم النظام عبر مكتبة إنفيديا FlashDreams المُسرّعة للاستنتاج بالتدفق، مما يتيح التحكم التفاعلي من قبل شخص أو سياسة مُتعلَّمة في حلقة مغلقة.

media Latent Space · منذ 16 يوم · 4 مشاهدات

Black Forest Labs تطلق نماذج التدفق متعددة الوسائط FLUX 3 ونموذج الروبوتات FLUX-mimic

أطلقت Black Forest Labs نموذج FLUX 3، وهو عائلة من نماذج التدفق متعددة الوسائط تتضمن قدرات توليد الفيديو مع الصوت الأصلي. يتضمن الإصدار أيضًا FLUX-mimic، وهو متغير مصمم لتطبيقات الروبوتات الخاصة بحركة الفيديو.

lab Hugging Face Blog · منذ 19 يوم · 8 مشاهدات

نظرة عامة على محركات المحاكاة للذكاء الاصطناعي المادي: MuJoCo وIsaac Sim وNewton

تقدم هذه المقالة نظرة عامة على الحالة الحالية للمحاكاة في مجال الذكاء الاصطناعي المادي، موضحاً كيف تسد المحاكاة الفجوة البياناتية للروبوتات من خلال تمكين بيئات تدريب قابلة للتوسع وذات واقعية بصرية عالية. وتحدد المقال نموذجاً يعتمد على ثلاثة حواسيب (التدريب، والمحاكاة، وعلى الروبوت)، وتصنف محركات المحاكاة الرئيسية بناءً على قدراتها المحددة وحالات الاستخدام الخاصة بها.

media MarkTechPost · منذ 19 يوم · 4 مشاهدات

إنفيديا تطلق كوزموس 3 إيدج، نموذج عالم مفتوح بحجم 4 مليارات معلمة لاستدلال الروبوتات على الجهاز

أطلقت إنفيديا نموذج كوزموس 3 إيدج، وهو نموذج عالم مفتوح يتكون من 4 مليارات معلمة مصمم للعمل على الجهاز للروبوتات ووكلاء الذكاء الاصطناعي للرؤية. أُصدر في 20 يوليو على منصة Hugging Face، مما يتيح للنظم فهم المحيط والاستدلال في الوقت الفعلي وتوليد إجراءات الروبوت محليًا دون الاعتماد على السحابة.

lab Hugging Face Blog · منذ 19 يوم · مشاهدتان

بولين روبوتكس تطلق غرابيت، نظام مفتوح منخفض التكلفة لتسجيل بيانات المناورة الروبوتية

أطلقت بولين روبوتكس (Pollen Robotics) جهاز غرابيت (Grabette)، وهو جهاز محمول مفتوح المصدر مصمم لتسجيل بيانات المناورة الروبوتية في العالم الحقيقي دون الحاجة إلى روبوت أو معدات للتحكم عن بعد. يستخدم النظام كاميرا عين السمكة وكاميرا عمق RGBD لالتقاط مسارات ذات 6 درجات من الحرية، مما يتيح للمستخدمين إنشاء مجموعات بيانات نظيفة يمكن معالجتها عبر لوحة تحكم تعمل على المتصفح ومشاركتها على Hugging Face Hub.

lab Hugging Face Blog · منذ 20 يوم · مشاهدة واحدة

إنفيديا تطلق Cosmos 3 Edge، نموذجًا بـ4 مليارات معلمة للتحكم في الروبوتات في الوقت الفعلي على الأجهزة الطرفية

أطلقت إنفيديا Cosmos 3 Edge، وهو نموذج عالم مفتوح بـ4 مليارات معلمة مصمم لتقديم أداء بمستوى مراكز البيانات على الأنظمة الطرفية ذات الذاكرة المحدودة. يمكّن النموذج الروبوتات ووكلاء الذكاء الاصطناعي للرؤية من فهم محيطهم، والاستدلال في الوقت الفعلي، وتوليد الإجراءات مباشرةً على أجهزة مثل وحدات NVIDIA Jetson.

media MarkTechPost · منذ 23 يوم

مسترال آي تطلق روبوسترال نافيجيت، نموذجًا بحجم 8B للملاحة الروبوتية بكاميرا واحدة

أطلقت مسترال آي روبوسترال نافيجيت، وهو أول نموذج مصمم للملاحة الجسدية باستخدام كاميرا RGB واحدة فقط. يقبل النموذج ذو الـ 8 مليار معلمة تعليمات بلغة طبيعية وإدخالات صورية لتوجيه الروبوتات عبر بيئات معقدة مثل المكاتب والإعدادات الخارجية.

arxiv arXiv cs.LG · منذ 23 يوم · مشاهدتان

يوسع RoboTTT سياسات الروبوت إلى سياق من 8 آلاف خطوة زمنية

يقدم الباحثون RoboTTT، وهي وصفة تدريب تمدد السياق البصري-حركي لنماذج الروبوت الأساسية إلى 8,000 خطوة زمنية دون زيادة زمن الاستدلال. تدمج الطريقة التدريب في وقت الاختبار في سياسات الرؤية-اللغة-الإجراء باستخدام أوزان سريعة يتم تحديثها عبر النزول التدرجي أثناء كل من التدريب والاستدلال.

arxiv arXiv cs.AI · منذ 23 يوم

يوسع RoboTTT سياسات الروبوت إلى سياق من 8 آلاف خطوة زمنية

تُقدم إنفيديا نموذج RoboTTT، وهو نموذج أساسي للروبوتات وصفة تدريب تمدد السياق الحسي-حركي إلى 8000 خطوة زمنية دون زيادة زمن الاستدلال. من خلال دمج التدريب أثناء الاختبار في سياسات الرؤية-اللغة-الإجراء، يضغط النظام التاريخ إلى فضاء الأوزان باستخدام أوزان سريعة تُحدَّث عن طريق النزول التدرجي.

arxiv arXiv cs.AI · منذ 23 يوم SWE-bench Pro · 63.2%

شاومي تطلق U0، نموذجًا موحدًا للتوليد الجسدي يحتوي على 38 مليار معامل

أعلنت شاومي عن Xiaomi-Robotics-U0، وهو نموذج متعدد الوسائط ذاتي الانحدار يحتوي على 38 مليار معامل، مصمم للتوليد الموحد للجسد. يعالج النموذج التوليد الجسدي كتمديد لتوليد الصور ومقاطع الفيديو الأساسية، حيث يحسن بشكل مشترك توليد الصور من النص، وتحرير الصور، وتوليد المشاهد الجسدية، والنقل الجسدي، وتوليد مقاطع الفيديو الجسدية.

arxiv arXiv cs.AI · منذ 27 يوم · مشاهدة واحدة

إطار ما بعد التدريب PAC-ACT يحسّن سياسات ACT للتلاعب باللمس الدقيق

تقدم هذه الورقة بحثية إطار PAC-ACT، وهو إطار ما بعد التدريب للتعزيز المعزز مصمم لتعزيز سياسات Action Chunking Transformer (ACT) المدربة مسبقًا لمهام اللمس الدقيقة الصناعية. تعيد الطريقة صياغة تحسين السياسات على مستوى القطع وتستخدم بنية وكيل-ناقد منقولة بواسطة ACT مع قيد أولي سلوكي هجين.

lab NVIDIA Technical Blog · منذ 28 يوم · مشاهدة واحدة

إنفيديا تقدم طريقة لتقييم سياسات الروبوتات العامة

تتعامل إنفيديا مع تحدي التقييم الدقيق لنماذج الأساس الخاصة بالروبوتات، والتي يمكنها الآن اتباع تعليمات اللغة الطبيعية للتحكم في الأشياء. تحدد الشركة التقييم كمشكلة حرجة غير محلولة وتقدم طريقة جديدة لمعالجة هذه القضايا.