एक अध्ययन ने 150 कृत्रिम पोलिश-भाषा प्राथमिक स्वास्थ्य देखभाल परामर्शों में क्लिनिकल AI सिस्टम Doctorina की तुलना आठ चिकित्सकों और चार स्वतंत्र फ्रंटियर भाषा मॉडलों से की।
- Doctorina ने 82.0% टॉप-1 निदान सहमति हासिल की, जो चिकित्सकों के 57.0% प्रदर्शन से काफी बेहतर है।
- AI सिस्टम ने प्राथमिक या संदर्भ भेदभाव सहमति में 97.3% तक पहुंचा, जबकि डॉक्टरों के लिए यह 85.0% था।
- सामान्यीकृत कार्य और उपचार स्कोर Doctorina के लिए (89.4 और 83.7) चिकित्सकों (66.9 और 61.2) की तुलना में अधिक थे।
- निदान में Kimi K3 अगले स्थान पर था, जबकि Claude Opus 5 निकटतम शीर्ष प्रदर्शकों के बीच प्रबंधन अनुमानों में अग्रणी था।
परिणाम संकेत करते हैं कि Doctorina का लाभ प्राथमिक निदान चयन से लेकर अनुकूलित परामर्श के बाद उच्च-रेटेड निदान कार्य और प्रारंभिक उपचार तक फैला हुआ है।