कम और मध्यम आय वाले सेटिंग्स के लिए डिज़ाइन किया गया एक उद्देश्य-निर्मित पुनर्प्राप्ति-वर्धित जनरेशन (RAG) सिस्टम जिसका नाम VITA है, को HealthBench बेंचमार्क पर सामान्य-उद्देश्य वाले बड़े भाषा मॉडल्स के खिलाफ आंकलन किया गया। GPT-4.1 जज द्वारा स्कोर किए गए 4,023 प्रश्नों पर, VITA ने संभावित रूब्रिक अंकों में से 51.9% के साथ पहले स्थान पर रहे, जिसमें GPT-5.4, o4-mini, Gemini 3.1 Pro और Claude Sonnet 4.6 को पीछे छोड़ दिया।
जब एक तटस्थ ओपन-वेट जज का उपयोग करके नए मॉडल्स के खिलाफ पुनः आंकलन किया गया, तो VITA ने प्रति प्रश्न औसत स्कोर में GPT-5.5 के बराबर हासिल किया, जबकि अंकों-वजन वाले स्कोर पर अग्रणी रहा और सबसे अधिक प्रश्नों में जीता। अध्ययन संकेत देता है कि कॉर्पस विशिष्टता क्लिनिकल संदर्भों में ग्राउंडिंग को बेहतर बनाती है, जिससे विशेष सिस्टम कम संचार पॉलिश के बावजूद फ्रंटियर LLMs के साथ प्रतिस्पर्धात्मक बने रह सकते हैं।