AI agents
media TLDR AI · منذ 2 ساعة · 10 مشاهدات

أنثروبيك تطلق كلاود بروjects v2؛ جوجل تقدم وكيل عائلي

أطلقت أنثروبيك كلاود بروjects v2، معادًا تصميم الميزة من هيكل يعتمد على المجلدات إلى واجهة تقودها المحادثات تدير الإنشاءات من خلال تفويض المهام والخيط المتوازي. في الوقت نفسه، تختبر جوجل وكيل عائلي يعمل على جهاز سحابي مخصص لتنسيق الأنشطة لما يصل إلى ستة أفراد من الأسرة.

media TLDR AI · منذ 2 ساعة AIME 2024 · 50.0% · 9 مشاهدات

ميتا تفتح موصلات Muse، وتطلق SAM 3.1، وGemini يخترق الأنظمة

يغطي هذا التحديث عدة تطورات في مشهد الذكاء الاصطناعي، بما في ذلك فتح ميتا لمنصتها Muse أمام مطوري الطرف الثالث، وإصدار إصدار جديد من نموذج التقسيم الخاص بها، وحادث أمني يتعلق بـ Gemini من جوجل.

media TLDR AI · منذ 2 ساعة · 10 مشاهدات

شاومي تطلق نماذج MiMo-V2.6 Pro و Flash كمصدر مفتوح

أطلقت شاومي نماذج omnimodal الخاصة بها MiMo-V2.6 Pro و Flash كمصدر مفتوح، وهي مصممة لتنسيق الوكلاء لبناء واختبار مشاهد ثلاثية الأبعاد تفاعليًا بصريًا. يمكن لهذه النماذج توليد أصول Blender، والتحكم في أذرع الروبوت من تدفقات الكاميرا، وإنشاء واجهات أمامية وعروض تقديمية، وتجميع مقاطع الفيديو، وتأليف الموسيقى كنوتات موسيقية و MIDI.

arxiv arXiv cs.AI · منذ 2 ساعة · 9 مشاهدات

يتيح AIDE^2 التحسين الذاتي المتكرر لوكلاء البحث في الذكاء الاصطناعي

يقدم الباحثون نظام AIDE^2، الذي يطبق حلقة من التحسين الذاتي المتكرر لوكيل بحث ذكي من خلال تحسين شيفرته الخاصة. يقترح النظام تغييرات على منطقِه الداخلي، ويقيّم النسخ المعدّلة في مهام البحث والتطوير للذكاء الاصطناعي، ويحتفظ فقط بتحسينات التي حققت أفضل أداء في التقييمات المخفية.

arxiv arXiv cs.AI · منذ 3 ساعة WebArena · 45.3% · 13 مشاهدة

تحويل "Growing Harness" التحكم المتكرر للوكيل إلى كود قابل لإعادة الاستخدام عبر التدريب الموجه بالفشل

يقدم المؤلفون "Growing Harness"، وهو نموذج تدريبي يتعلم بنية تحكم الوكيل من ملاحظات المهمة بدلاً من الاعتماد على السقالات التقليدية الثقيلة بالسياق. ومن خلال تحويل قرارات التحكم المتكررة إلى كود قابل للتنفيذ وحجز استدعاءات نماذج اللغات الكبيرة (LLM) للاستدلال الدلالي، تهدف هذه الطريقة إلى إنشاء وكلاء متخصصين قابلين لإعادة الاستخدام.

arxiv arXiv cs.AI · منذ 4 ساعة · 9 مشاهدات

يقلل CliffCompaction تكاليف وكلاء البرمجة بنسبة 50% مع الحفاظ على الأداء

يقدم الباحثون تقنية CliffCompaction، وهي طريقة ضغط تلقائي مصممة لتخفيض التكاليف لوكلاء البرمجة طويلي المدى بنسبة تصل إلى 50% ضمن سياق محدود. تحافظ الطريقة على الأداء أو تحسّنه في Terminal-Bench وتحقق نتائج متقدمة في KernelBench من خلال الحفاظ على دقة المعلومات المضغوطة عبر الاقتطاع بدلاً من إعادة الصياغة.

arxiv arXiv cs.LG · منذ 4 ساعة · 11 مشاهدة

يتيح AIDE^2 التحسين الذاتي المتكرر لوكلاء أبحاث الذكاء الاصطناعي

يقدم الباحثون نظام AIDE^2، الذي يطبق حلقة من التحسين الذاتي المتكرر لوكيل أبحاث ذكاء اصطناعي متقدم من خلال تحسين شيفرته الخاصة. يقترح النظام تغييرات على منطقِه الداخلي، ويقيّم الإصدارات المعدّلة في مهام بحث وتطوير الذكاء الاصطناعي، ويحتفظ فقط بتلك التحديثات التي تحقق أفضل أداء في التقييمات المخفية.

arxiv arXiv cs.LG · منذ 5 ساعة · 9 مشاهدات

يقلل CliffCompaction تكاليف وكلاء البرمجة طويلة المدى بنسبة تصل إلى 50% مع الحفاظ على الأداء

يقدم الباحثون تقنية CliffCompaction، وهي طريقة ضغط ذاتي مصممة للوكلاء الذين يتعاملون مع ملايين الرموز (tokens)، مما يقلل التكاليف بنسبة تصل إلى 50% ضمن سياق محدود. تحافظ الطريقة على الأداء أو تحسّنه في Terminal-Bench وتحقق نتائج رائدة في KernelBench من خلال الحفاظ على دقة المعلومات عبر الاقتطاع بدلاً من إعادة الصياغة.

arxiv arXiv cs.CL · منذ 7 ساعة · 11 مشاهدة

Qwen تطلق Qwen3.8-Omni-Flash، نموذجًا متعدد الوسائط أصليًا مع سياق مكون من مليون رمز

أعلنت Alibaba Cloud عن إطلاق Qwen3.8-Omni-Flash، وهو نموذج متعدد الوسائط أصليًا مصمم لمهام الإنتاجية في العالم الحقيقي، والذي يحسّن بشكل كبير الفهم والاستدلال متعدد الوسائط مقارنة بالنماذج السابقة.

lab xAI News · منذ 10 ساعة · 15 مشاهدة

تستخدم SpaceXAI روبوت Grok للتعامل مع طفرة بنسبة 175% في التذاكر دون توظيف

قامت SpaceXAI بدمج وكيل الذكاء الاصطناعي الخاص بها، Grok Bot، في عملية دعم العملاء الموحدة بعد استحواذها على Cursor، مما مكن الفريق من إدارة زيادة بنسبة 175% في عدد التذاكر دون إضافة موظفين. وتجنب الشركة توظيف حوالي 200 عضو إضافي في الطاقم، وخفضت تكاليف الحل لتتراوح بين 0.20 دولار و0.30 دولار لكل تذكرة من خلال الاستفادة من نموذج التسعير القائم على الاستخدام في Grok Bot.

lab OpenAI News · منذ 11 ساعة · 16 مشاهدة

تقليل وقت البحث والتكلفة إلى النصف باستخدام GPT-6 Astra

قامت Parallel بدمج GPT-6 Astra من OpenAI في بنية وكلاء الذكاء الاصطناعي الخاصة بها، محققةً انخفاضاً بنسبة 50% في كل من وقت البحث وتكاليف البرمجيات مقارنة بالنماذج السابقة. تبلغ الشركة أن النموذج الجديد يسمح للوكلاء بإكمال أعمال المعرفة المعقدة بشكل أسرع بكثير مع الحفاظ على جودة عالية للإخراج.

lab OpenAI News · منذ 13 ساعة · 22 مشاهدة

تحسين OpenAI لتخزين دفاتر الأوامر في GPT-6 بمعدلات إصابة أعلى وأدوات تشخيصية

أطلقت OpenAI نظامًا محسّنًا لتخزين دفاتر الأوامر لعائلة GPT-6، يوفر معدلات إصابة بالمخزن الافتراضي بشكل تلقائي، ويمنح خصومات تصل إلى 90% على رموز الإدخال المخزنة. يُقدّم التحديث أدوات جديدة لمساعدة المطورين على مراقبة الأداء، وتشخيص حالات عدم الإصابة، وتحسين تكاملاتهم.

lab Claude Code Releases · منذ 16 ساعة · 14 مشاهدة

يضيف Claude Code v2.1.280 نموذج Claude Opus 5.5 ويصلح العديد من الأخطاء

تُقدم نسخة Claude Code الإصدار 2.1.280 نموذج Claude Opus 5.5 كإصدار Opus الافتراضي الجديد، مع نافذة سياق بسعة 1M وتسعير محدّث. يضيف التحديث أيضاً دعم عجلة الماوس لتصفح القوائم في وضع ملء الشاشة، ويسمح بضبط حدود طول وصف أدوات MCP.

arxiv arXiv cs.AI · منذ 22 ساعة · 11 مشاهدة

مولد حالة العالم يزامن الخطط مع العوالم الاصطناعية لتحسين نجاح الوكيل

مولد حالة العالم (WSG) هو نموذج يحافظ على مزامنة خطط وكلاء اللغة مع قواعد بيئة التنفيذ الخاصة بهم عن طريق إعادة كتابة الحالات بعد الفشل. تم تدريبه على 226K مسارًا مستخرجًا من سبعة مجالات اصطناعية حيث يفرض برنامج القواعد ويتحقق من إمكانية الوصول إلى الهدف.

media Latent Space · منذ 22 ساعة · 11 مشاهدة

شاومي تطلق MiMo-V2.6-Pro، نموذجًا متعدد الوسائط مفتوح الأوزان من الطراز الأول تم تدريبه بتكلفة 3 ملايين دولار

أطلقت شاومي سلسلة MiMo-V2.6، مقدمةً نماذج متعددة الوسائط بشكل أصلي تشمل MiMo-V2.6-Pro وMiMo-V2.6-Flash. كما أطلقت الشركة MiMo-V2.6-Pro-UltraSpeed، الذي يوفر سرعة إخراج أسرع بـ 20 مرة بنفس الجودة.

media Hugging Face Forums · منذ 1 يوم · 10 مشاهدات

القيود الموزعة في الذكاء الاصطناعي متعدد الوكلاء تحكم الوكلاء دون هوية جماعية

يبرز تحليل جديد ظاهرة في الأنظمة متعددة الوكلاء حيث تكتسب العلاقات الناتجة بين وكلاء يتم التحكم بهم بشكل منفصل قوة حكم عبر المجموعة. يحدث هذا عندما يترك الوكلاء رسائل وأثارًا دائمة تقيد مسارات بعضها البعض، مما يخلق توجهًا موزعًا فعالاً غير محدد بالمهام الفردية.

media Hugging Face Forums · منذ 1 يوم · 10 مشاهدات

جيبسالييس يجرب SelMem، نظام ذاكرة انتقائي للنماذج اللغوية الكبيرة

قام المؤلف بتطوير مشروع رست (Rust) يُدعى SelMem لتجربة ذاكرة غير مثالية ومعتمدة على المسار للنماذج اللغوية الكبيرة. يحاكي هذا النهج الذاكرة البشرية من خلال السماح للوكلاء بضغط النسيان وإعادة بناء الذكريات مع مرور الوقت بدلاً من تخزين نسخ مثالية من التفاعلات.

arxiv arXiv cs.AI · منذ 1 يوم · 9 مشاهدات

يقلل AgentRouter تكاليف سير العمل الوكيلّي بنسبة 72٪ عبر توجيه النماذج على مستوى الخطوات

يقترح الباحثون AgentRouter، وهو مصنف خفيف الوزن يحسّن سير العمل الوكيلّي متعدد الخطوات عن طريق توجيه خطوات المسار الفردية إلى طبقات نماذج مناسبة بدلاً من استخدام أحدث النماذج لكل مهمة. يعالج النظام عدم كفاءة الحلول الحالية التي تتجاهل تعقيد المهام الفرعية المتفاوتة داخل جلسة وكيل واحدة.