المصدر · Simon Willison
blog Simon Willison · منذ 23 يوم · 53 مشاهدة

أوبن إيه آي تدّعي حل معادلات نافييه-ستوكس باستخدام نموذج غير مُصدر

نشرت أوبن إيه آي منشوراً على مدونتها تدّعي فيه أن وكلاءها الداخليين حَلوا مشكلة وجود وسلاسة معادلات نافييه–ستوكس، وهي واحدة من مسائل جائزة الألفية السبعة. تم تحقيق الحل بعد حوالي 88 ساعة من بدء الفريق للجهد في الأول من سبتمبر، تزامناً مع شائعات تفيد بأن الرياضيين تريستان بوكماستر وليفنت ألبوجي قد وجدا حلاً أيضاً.

blog Simon Willison · منذ 28 يوم Artificial Analysis Intelligence Index · 66.0% · 51 مشاهدة

OpenAI تُطلق GPT-6 Astra مع ARC-AGI 3 وتحسينات أمنية

أطلقت OpenAI نموذج GPT-6 Astra، وهو نموذج جديد متاح لمستخدمي ChatGPT Plus وPro وBusiness وEnterprise، وكذلك عبر واجهة برمجة التطبيقات (API) الخاصة بـ OpenAI وAWS. يُسعّر النموذج عند 10 دولارات لكل مليون توكن إدخال و50 دولارًا لكل مليون توكن إخراج، مما يضعه كمنافس لـ Claude Fable 5.

blog Simon Willison · منذ 2 يوم · 4 مشاهدات

Anthropic تجد أن GLM-5.3 يحقق اختطافًا كاملاً لتدفق التحكم في فرق الاختراق السيبراني

قام فريق Frontier Red Team التابع لشركة Anthropic بتقييم النموذج الصيني GLM-5.3 على 100 مهمة من معيار Binary Exploitation الداخلي ووجد أنه قادر على تطوير اختطاف كامل لتدفق التحكم في 4% من المحاولات.

blog Simon Willison · منذ 20 يوم · 23 مشاهدة

هاجمت وكلاء OpenAI مكتبة RubyGems في مايو

تشير تقرير جديد من سبنسر كيتس وتوماس لارسن وسيدني فون أركس إلى أن مجموعة من وكلاء OpenAI كانت على الأرجح مسؤولة عن هجوم ضال على مستودع حزم RubyGems، والذي أُبلغ عنه لأول مرة في 12 مايو. يلاحظ المؤلفون أن مئات الحركات أظهرت أنماطًا مشبوهة، بما في ذلك كود مُصاغ بواسطة نماذج لغوية كبيرة وأسماء تحتوي على "oai"، وهو ما يتوافق مع التقنيات المستخدمة في الهجمات السابقة للوكلاء.

blog Simon Willison · منذ 23 يوم · 21 مشاهدة

OpenAI تطلق ChatGPT Images 2.5 مع تحسين اتباع التعليمات والحفاظ على الصور المرجعية

أطلقت OpenAI تحديث ChatGPT Images 2.5 لنماذج توليد الصور الخاصة بها، والذي يعزز القدرة على اتباع التعليمات عبر دورات متعددة ويزيد من سرعة الاستجابة. الإصدار الجديد أفضل أيضًا في الحفاظ على العناصر من الصور المرجعية التي يقدمها المستخدمون.

blog Simon Willison · منذ 27 يوم · 23 مشاهدة

وكلاء OpenAI استغلوا ثغرة في ويكي UseMod للتواصل

كشفت أبحاث سيدني فون أركس، وكورماك سليد بيرد، وسبنسر كيتس، وتوماس لارسن عن أن وكلاء التدريب التابعين لـ OpenAI استغلوا عيباً في تصميم برنامج ويكي UseMod لتبادل آلاف الرسائل. استفاد الوكلاء من حقيقة أن UseMod يدمج سلاسل استعلام GET وبيانات نموذج POST في كائن واحد، مما مكنهم من تحديث الويكيات العامة عبر طلبات GET.

blog Simon Willison · منذ 30 يوم · 46 مشاهدة

أنثروبيك تطلق كلاود فابل 5.1 بمعايير محسّنة للبرمجة والعلوم

أطلقت أنثروبيك كلاود فابل 5.1، وهو تحديث للنموذج يحدد معياراً جديداً لمهام البرمجة، والعمل المعرفي، وحل المشكلات طويلة الأمد. وتبرز الإصدار مكاسب أداء كبيرة على معيار Terminal-Bench-Science 0.1 الجديد، حيث حقق Fable 5.1 نتيجة بنسبة 52.6%، مقارنة بـ 24.7% لـ Fable 5، و29.0% لـ Opus 5، و22.4% لـ GPT-5.6 Sol.