Специализированная система генерации с дополнением извлечения (RAG) под названием VITA, предназначенная для стран с низким и средним уровнем дохода, была оценена на бенчмарке HealthBench по сравнению с универсальными большими языковыми моделями. На 4023 вопросах, оцененных судьей GPT-4.1, VITA заняла первое место с 51,9% возможных баллов по рубрике, превзойдя GPT-5.4, o4-mini, Gemini 3.1 Pro и Claude Sonnet 4.6.
При повторной оценке с использованием более новых моделей и нейтрального судьи с открытым весом VITA достигла паритета с GPT-5.5 по среднему баллу за вопрос, лидировала по взвешенному по баллам показателю и выиграла наибольшее количество вопросов. Исследование показывает, что специфичность корпуса улучшает привязку к контексту в клинических условиях, позволяя специализированным системам оставаться конкурентоспособными по сравнению с передовыми LLM, несмотря на потенциально менее отточенное коммуникативное оформление.