قارنت دراسة نظام الذكاء الاصطناعي السريري Doctorina مع ثمانية أطباء وأربعة نماذج لغوية حدودية مستقلة عبر 150 استشارة رعاية أولية بولندية اصطناعية.

  • حققت Doctorina توافقًا تشخيصيًا من النوع Top-1 بنسبة 82.0٪، متفوقةً بشكل كبير على أداء الأطباء البالغ 57.0٪.
  • وصل نظام الذكاء الاصطناعي إلى توافق تفاضلي أولي أو مرجعي بنسبة 97.3٪ مقارنة بـ 85.0٪ للأطباء.
  • كانت درجات العمل والعلاج المعيَّنة أعلى لـ Doctorina (89.4 و 83.7) منها للأطباء (66.9 و 61.2).
  • احتل Kimi K3 المرتبة التالية في التشخيص، بينما قاد Claude Opus 5 تقديرات الإدارة بين الأداءين المتقدمين المتقاربين.

تشير النتائج إلى أن ميزة Doctorina تمتد من اختيار التشخيص الأولي إلى عمل تشخيصي وعلاج أولي مُقيَّم بشكل أعلى بعد استشارة تكيفية.