الموضوع · AI agents
lab Google DeepMind Blog · منذ 1 يوم Code Arena (Elo) · 1588.0Elo · 7 مشاهدات

جوجل تقدم Gemini 3.7 Flash مع تحسينات في البرمجة وتكلفة أقل

أطلقت جوجل نموذج Gemini 3.7 المحدث، وهو نموذج مُصمم لتعزيز قدرات البرمجة، وسير عمل الوكلاء، وأعمال المعرفة. يأتي هذا الإصدار بعد ثلاثة أسابيع من النسخة السابقة، ويجمع بين ملاحظات المطورين والابتكارات الخوارزمية.

lab OpenAI News · منذ 1 يوم BrowseComp · 84.36% · 8 مشاهدات

OpenAI تطلق GPT-5.6 لسير عمل وكيلي فعال من حيث التكلفة وعالي الأداء

أطلقت OpenAI عائلة نماذج GPT-5.6، المصممة لتقديم أداء وكيل على مستوى متقدم بتكاليف أقل بشكل ملحوظ من خلال تحسين جهد الاستدلال وإدخال عناصر تحكم جديدة في واجهة برمجة التطبيقات (API). يتيح التحديث للشركات الناشئة بناء وكلاء أسرع وأكثر قدرة باستخدام نماذج أصغر مثل Luna وTerra للمهام عالية الحجم، مع الاحتفاظ بالنماذج الأكبر للحكم المعقد.

lab OpenAI News · منذ 14 يوم · 23 مشاهدة

نموذج أسترا يحل عشر مسائل مفتوحة في الرياضيات وعلوم الحاسوب النظرية

أنتج النموذج الداخلي أسترا التابع لشركة OpenAI حلولاً لعشر مسائل مفتوحة طويلة الأمد عبر مجالي الرياضيات وعلوم الحاسوب النظرية، مع توثيق الحجج بشكل رسمي باستخدام Lean. تمتد هذه النتائج لتشمل الهندسة متعددة الأبعاد، ونظرية الترميز، ونظرية الزمر، والتعقيد الكمي، حيث عالجت أسئلة لم تشهد أي تقدم لمدة عشر سنوات على الأقل.

lab Google DeepMind Blog · منذ 15 يوم · 8 مشاهدات

جوجل تقدم Gemini Robotics 2 للتحكم في الجسم بالكامل والتعاون بين الروبوتات المتعددة

قدمت جوجل Gemini Robotics 2، وهي طبقة ذكاء مصممة لتزويد الروبوتات القابلة للتكيف بالتحكم الذكي بالجسم بالكامل، والبراعة المتقدمة، والقدرة على التعاون في فرق. يوسع هذا التحديث قدرات الذكاء الاصطناعي المادي بما يتجاوز المهام الضيقة والمتكررة من خلال تمكين الروبوتات من التفكير في الحركات والتكيف بسرعة مع أجسام جديدة.

lab Google DeepMind Blog · منذ 18 يوم GDPval-AA (Elo) · 1421.0Elo · 26 مشاهدة

جوجل تطلق Gemini 3.6 Flash و3.5 Flash-Lite و3.5 Flash Cyber

أعلنت جوجل عن ثلاثة نماذج جديدة في سلسلة Flash: Gemini 3.6 Flash، و3.5 Flash-Lite، و3.5 Flash Cyber، مصممة لتحسين كفاءة الرموز (tokens)، وتقليل زمن الاستجابة، والموثوقية لوكلاء الذكاء الاصطناعي في البيئات الإنتاجية.

lab Anthropic News · منذ 21 يوم · 20 مشاهدة

أنثروبيك تطلق كلاود أوبوس 5 للبرمجة والوكلاء طويلي التشغيل

أطلقت أنثروبيك كلاود أوبوس 5، وهو نموذج جديد صُمم لتشغيل الوكلاء طويلي التشغيل مع تقديم تحسينات كبيرة في البرمجة والأعمال المهنية. يُصنف كتحسن جذري لدرجة أوبوس، حيث يقدم أداءً قريباً من كلاود فابل 5 بنصف التكلفة.

lab Google — The Keyword (AI) · منذ 3 يوم · 40 مشاهدة

جوجل تُظهر قدرات الاستشارة السريرية بالفيديو في الوقت الفعلي باستخدام AMIE

قدمت Google Research وGoogle DeepMind تقدمًا في نظام الذكاء الاصطناعي الطبي الخاص بها للبحث، AMIE، لإظهار قدرات الاستشارة السريرية بالفيديو في الوقت الفعلي في دراسة من نوعها لأول مرة. تم بناء النظام على Gemini وProject Astra باستخدام بنية متعددة الوكلاء، حيث يفسر الإشارات البصرية والسمعية، ويوجه الفحوصات الجسدية الافتراضية، ويقوم بالاستدلال التشخيصي في الوقت الفعلي.

lab xAI News · منذ 3 يوم · 42 مشاهدة

إكس آي تطلق Grok Bot، وكلاء ذكاء اصطناعي يعملون دائمًا على سطح المكتب وiOS

أطلقت إكس آي (xAI) النسخة التجريبية من Grok Bot، مقدمةً نظامًا لوكلاء الذكاء الاصطناعي الذين يعملون دائمًا، ويعملون على حاسوب سحابي خاص بهم لمعالجة المهام من البداية إلى النهاية. متاح اليوم للمشتركين في SuperGrok Heavy وCursor Ultra وCursor Teams Premium على سطح المكتب وiOS، تعمل البوتات عبر التطبيقات والأدوات دون الحاجة إلى إعداد سير عمل يدوي.

lab OpenAI News · منذ 7 يوم · 10 مشاهدات

أنثروبيك توقف تطوير أسترا بعد تقييمات داخلية تشير إلى قدرات سيبرانية حرجة

أوقفت أنثروبيك الأنشطة الداخلية المتعلقة بنموذجها القادم، أسترا، لأن التقييمات الأخيرة تشير إلى أنه قد يمتلك قدرات حرجة لأمن السيبرانية بموجب إطار الاستعداد الخاص بالشركة. لا يمكن للشركة استبعاد إمكانية أن يتمكن النموذج من تحديد وتطوير استغلاالات يوم صفر وظيفية في أنظمة العالم الحقيقي المحصنة دون تدخل بشري.

lab OpenAI News · منذ 11 يوم · 15 مشاهدة

مهندسو OpenAI يُطلقون GPT-Live، نظام صوتي ثنائي الاتجاه يزيل كاشفات تبادل الأدوار

أطلقت OpenAI نظام GPT-Live، وهو الجيل الثالث من الأنظمة الصوتية الذي يلغي كاشف تبادل الأدوار التقليدي باستخدام نموذج ثنائي الاتجاه قادر على الاستماع والتحدث في وقت واحد. يسمح هذا التصميم بمحادثات أكثر فورية وطبيعية مع الحفاظ على زمن انتقال منخفض من خلال تصميم نظام جديد مُحسّن للأداء في الوقت الفعلي.

lab Microsoft Research Blog · منذ 11 يوم SWE-bench Verified · 69.7% · 15 مشاهدة

أبحاث مايكروسوفت تطلق إطار عمل Orchard للذكاء الاصطناعي الوكيل القابل للتوسع

أطلقت أبحاث مايكروسوفت إطار عمل Orchard، وهو إطار مفتوح المصدر مصمم لتمكين البحث القابل للتوسع والفعال من حيث التكلفة حول الوكلاء المستقلين. يركز النظام على Orchard Env، وهي خدمة بيئة قائمة على Kubernetes تتيح للباحثين تدريب وتقييم الوكلاء عبر مجالات متنوعة مثل هندسة البرمجيات، وتنقل الويب، والمساعدة الشخصية دون الحاجة إلى إعادة بناء البنية التحتية.

lab OpenAI News · منذ 14 يوم ARC-AGI 3 · 38.3% · 16 مشاهدة

OpenAI تخفض سعر GPT-5.6 Luna بنسبة 80 في المئة

أعلنت OpenAI عن تخفيضات كبيرة في أسعار عائلة نماذج GPT-5.6، حيث انخفضت تكلفة GPT-5.6 Luna بنسبة 80 في المئة وGPT-5.6 Terra بنسبة 20 في المئة. تصف الشركة هذه التغييرات كجزء من استراتيجية أوسع لجعل الذكاء الاصطناعي المتقدم أكثر بأسعار معقولة وأكثر فائدة على نطاق واسع من خلال تحسين كفاءة البنية التحتية.

lab DeepSeek API Docs · منذ 15 يوم Terminal-Bench 2 · 82.7% · 38 مشاهدة

ديب سيك تطلق النسخة التجريبية العامة من DeepSeek-V4-Flash بقدرات وكيل محسّنة

أطلقت ديب سيك النسخة التجريبية العامة الرسمية لواجهة برمجة التطبيقات DeepSeek-V4-Flash، والتي تتميز بقدرات وكيل محسّنة بشكل كبير مقارنة بـ V4-Pro-Preview. تتضمن التحديث إعادة تدريب النموذج مع الحفاظ على بنيته وحجمه الأصليين.

lab Microsoft Research Blog · منذ 15 يوم · 7 مشاهدات

مايكروسوفت تطلق Echoverse لتدريب وكلاء استخدام الحاسوب

أطلقت مايكروسوفت ريسيرش Echoverse، وهو مجموعة من اثني عشر بيئة اصطناعية عميقة مصممة لتدريب وكلاء استخدام الحاسوب. تتضمن المبادرة عشرة عوالم محددة المجال وعالمين يركزان على القدرات، وقد بُنيت جميعها للحفاظ على حالة متماسكة ودقة سلوكية.

lab Google DeepMind Blog · منذ 15 يوم · 13 مشاهدة

جوجل تطلق نموذج Gemini Robotics ER 2 مع فهم الفيديو والتعاون متعدد الروبوتات

أطلقت جوجل نموذج Gemini Robotics ER 2، وهو نموذج جديد للاستدلال الجسدي مصمم لمساعدة الروبوتات على التفكير بسرعة وتخطيط المهام متعددة الخطوات في الوقت الفعلي. يقدم التحديث تحسينات كبيرة مقارنةً بالإصدار السابق ER 1.6، بما في ذلك تتبع التقدم المستمر المعتمد على الفيديو، وإيجاد اللحظات الدقيقة، وقدرات التعاون متعدد الروبوتات الأصلية.