الموضوع · Retrieval & RAG
lab OpenAI News · منذ 20 يوم · 35 مشاهدة

أوبن إيه آي تقدم شات جي بي تي للخدمات المالية مع بيانات مدمجة وGPT-6 Astra

أطلقت أوبن إيه آي شات جي بي تي للخدمات المالية، وهي تجربة مصممة خصيصاً تجمع بين قدرات الاستدلال في GPT-6 Astra وبيانات مالية متميزة مدمجة لمساعدة الفرق في البحث والنمذجة وإنشاء مواد العملاء. تم تطوير المنتج بالشراكة مع مورغان ستانلي وإيفركور لمعالجة التحديات الرئيسية في بنك الاستثمار وأبحاث الأسهم.

lab Google — The Keyword (AI) · منذ 13 يوم · 27 مشاهدة

الأمم المتحدة تطلق System Data Commons لتوحيد الإحصاءات العالمية

تطلق منظومة الأمم المتحدة UN System Data Commons، وهي منصة مفتوحة المصدر مبنية على Google's Data Commons، تجمع الإحصاءات العالمية في مورد واحد مترابط يُعرف باسم رسم المعرفة الجاهز للذكاء الاصطناعي. بدعم من Google.org، يهدف المشروع إلى جعل البيانات الحرجة متاحة عالمياً ومساعدة تتبع التقدم العالمي في الوقت الفعلي.

lab OpenAI News · منذ 29 يوم · 28 مشاهدة

OpenAI تضيف تكامل Epic EHR وملحق البيانات العامة للرعاية الصحية إلى ChatGPT

أعلنت OpenAI عن تكامل جديد يسمح للمنظمات الصحية بربط سياق المريض المصرح به من السجلات الصحية الإلكترونية Epic مع ChatGPT for Healthcare، بالإضافة إلى ملحق البيانات العامة للرعاية الصحية الذي يوفر وصولاً هيكليًا إلى مجموعات البيانات الرسمية.

lab Cohere Blog · منذ 3 ساعة · مشاهدة واحدة

كوهير تطلق نماذج التضمين Embed 5 Pro وFast

أطلقت شركة كوهير نموذج التضمين Embed 5، وهو عائلة جديدة من نماذج التضمين المتطورة المتاحة بطبقتي Pro وFast على واجهة برمجة التطبيقات (API) الخاصة بكوهير، ومنصة Microsoft Foundry، وAmazon SageMaker. تشارك الطبقتان فضاء تضمين مشتركًا واحدًا، مما يتيح للفرق إجراء الفهرسة باستخدام Pro لأعلى جودة، والاستعلام باستخدام Fast لتقليل زمن الاستجابة والتكلفة دون الحاجة إلى إعادة بناء الفهرس.

media MarkTechPost · منذ 7 ساعة · 4 مشاهدات

Perplexity تطلق Photon، مما يقلل زمن استجابة p99 للاسترجاع من 800 مللي ثانية إلى 65 مللي ثانية

أطلقت Perplexity Photon، وهو محرك استرجاع وترتيب داخلي مبني بلغة Rust يتولى الآن جميع حركة الإنتاج، ليحل محل مكون مفتوح المصدر كان مُشعبًا سابقًا. يتيح النظام الجديد وضع "البحث السريع" في واجهة برمجة تطبيقات Perplexity Search، مما يوفر زمن استجابة أقل بشكل ملحوظ لعمليات سير العمل الوكيلية.

lab Hugging Face Blog · منذ 1 يوم · مشاهدة واحدة

ProvenanceGuard يضيف تحققاً واعياً بالمصدر إلى وكلاء MCP

يُعد ProvenanceGuard طبقة تحقق ما بعد التوليد لوكلاء بروتوكول سياق النموذج (MCP)، تكتشف خلط المصادر عبر التأكد من إسناد الادعاءات إلى مصدر الأدلة الصحيح. يحلل النظام مسارات MCP الملتقطة دون إعادة تدريب الوكيل، حيث يقسم الإجابات إلى ادعاءات ويتحقق من تطابق مصدر الدعم مع المصدر المذكور أو الضمني في المخرجات.

arxiv arXiv cs.AI · منذ 2 يوم · مشاهدة واحدة

تستخدم RareDx تحسين السياسة المستندة إلى الرسم البياني لتحسين تشخيص الأمراض النادرة

يقدم المؤلفون نظام RareDx، الذي يربط بين الاستخدام الخاضع للرقابة للأدلة وتحسين السياسة المستندة إلى رسم بياني للمعرفة لمعالجة مشكلة الاستدلال ذي الذيل الطويل في تشخيص الأمراض النادرة. يجمع خط التدريب بين ما بعد التدريب Top-10 وRareDx-KGPO، الذي يسقط التوقعات في رسم بياني قياسي للأمراض ويكامل الأهمية المصنفة المدققة، وقرب علم التصنيف، والتشابه الطبي الحيوي، واتساق النمط الظاهري.

media Hugging Face Forums · منذ 2 يوم · مشاهدتان

غروك يربط مشروع كوفينانت بعمل روبرت هانسون دون طلب

أعلن مؤلف دفتر الأستاذ من نظير إلى نظير "كوفينانت" أن غروك على منصة إكس قارن بشكل مستقل مشروعه بعمل روبرت "غريزلي" هانسون، رغم عدم وجود أي موجه أو ذكر سابق. ويشكل هذا الحالة الثالثة التي يربط فيها نظام ذكاء اصطناعي كوفينانت بأعمال خارجية دون طلب.

arxiv arXiv cs.AI · منذ 3 يوم · 15 مشاهدة

يُقلل أسلوب "تسليط الضوء ثم التلخيص" من حجم الأدلة لتحسين فهم السياق الطويل

يقترح الباحثون منهج "تسليط الضوء ثم التلخيص" (H2S)، وهو نموذج يعتمد على الضغط ثم الاستدلال، يحدد الأدلة ذات الصلة بالسؤال ودمجها في ملخص مدمج قبل توليد الإجابة. يبني الفريق مجموعة بيانات H2S-Dataset بـ 6,647 مثالاً ويقدم H2S-RL لتقديم مكافآت على مستوى العملية لاختيار الأدلة.

arxiv arXiv cs.CL · منذ 3 يوم · 6 مشاهدات

يُضغط Highlight-Then-Summarize الأدلة لفهم أفضل للسياق الطويل

يقترح الباحثون نهج Highlight-Then-Summarize (H2S)، وهو نموذج ضغط ثم استدلال يحدد الأدلة ذات الصلة بالسؤال ودمجها في ملخص مدمج قبل توليد الإجابة. لدعم هذا النهج، أنشأ الفريق مجموعة H2S-Dataset بـ 6,647 مثالاً من 11 عائلة معايير وأدخل H2S-RL لمكافآت على مستوى العملية.

arxiv arXiv cs.CL · منذ 3 يوم · 7 مشاهدات

تسميم المستندات القديمة يتسبب في تجاوز الاسترجاع غير المحدّث للإجابات الصحيحة للنموذج

يحدد الباحثون "تسميم المستندات القديمة"، وهو فشل في المحاذاة الزمنية في التوليد المعزز بالاسترجاع (RAG) حيث يؤدي الدليل الخارجي القديم إلى تقديم النماذج لإجابات خاطئة رغم معرفتها بالإجابة الصحيحة دون استرجاع.

arxiv arXiv cs.CL · منذ 3 يوم · 7 مشاهدات

يقوم KuaFu بضغط سلوك المستخدم إلى فهم على نطاق المليار

تقدم Tencent نظام KuaFu، وهو طبقة موحدة لضغط السلوك تقوم بتكثيف سجل المستخدم الخام إلى تمثيلات مضغوطة لوكلاء المحادثة وأنظمة التوصية. يستخدم النظام مُوجِّهًا ثنائي المحور لضغط كل عنصر سلوكي إلى 2-4 رموز بعرض 128-256، مما يعالج الاختناقات في معالجة التسلسلات الطويلة لمليار مستخدم.

media Hugging Face Forums · منذ 3 يوم · 5 مشاهدات

تستخدم نماذج JEPA البيولوجية قيودًا بيولوجية لنمذجة تقدم الأمراض

يجمع مشروع مفتوح المصدر جديد يُسمى Biological JEJA بين تعلم التمثيلات على نمط JEPA والقيود البيولوجية لنمذجة كيفية تقدم الأمراض بمرور الوقت. تم اختبار النهج على بيانات ADNI الحقيقية من 2347 مريضًا ومقارنته بعدة نماذج أخرى.

arxiv arXiv cs.CL · منذ 7 يوم · 6 مشاهدات

يطبق R3Con مبادئ تحقيق الصلة لتحسين الاستدلال واسع النطاق

يقترح الباحثون R3Con، وهو أداة تشغّل مبادئ النظرية المعرفية لبناء تمثيلات فعّالة للسياقات الكبيرة جداً. يتعامل النظام مع تحدي تجميع المعلومات المترابطة المشتتة عبر مصادر شاسعة تتجاوز حدود سياق النموذج القياسية.

media Hugging Face Forums · منذ 9 يوم · 14 مشاهدة

جيبسالييس يجرب SelMem، نظام ذاكرة انتقائي للنماذج اللغوية الكبيرة

قام المؤلف بتطوير مشروع رست (Rust) يُدعى SelMem لتجربة ذاكرة غير مثالية ومعتمدة على المسار للنماذج اللغوية الكبيرة. يحاكي هذا النهج الذاكرة البشرية من خلال السماح للوكلاء بضغط النسيان وإعادة بناء الذكريات مع مرور الوقت بدلاً من تخزين نسخ مثالية من التفاعلات.

media Hugging Face Forums · منذ 11 يوم · 13 مشاهدة

توجيه المعنى يقلل من توكنات الإدخال لـ Qwen2.5 بنسبة 41% ووقت الاستجابة بنسبة 45% في اختبار ضغط السياق بـ 14K

أظهر اختبار ضغط وحدة معالجة الرسومات باستخدام نموذج Qwen2.5-7B-Instruct المجمد بدقة 4 بت على أسئلة الجسر في HotpotQA أن التوجيه الدقيق الواعي بالمهمة يحسن الكفاءة والدقة بشكل كبير تحت ظروف المشتتات العالية. قارنت الدراسة السياق الكامل المحدود مع مُختار دلالي واعٍ للاستعلام يحتفظ بـ 60% من الميزانية، مما كشف عن مكاسب كبيرة في السرعة والدقة.