Un estudio comparó el sistema de IA clínica Doctorina con ocho médicos y cuatro modelos de lenguaje fronterizos independientes en 150 consultas sintéticas de atención primaria en polaco.
- Doctorina logró una concordancia diagnóstica Top-1 del 82,0%, superando significativamente el rendimiento del 57,0% de los médicos.
- El sistema de IA alcanzó una concordancia con el diferencial primario o de referencia del 97,3% en comparación con el 85,0% de los doctores.
- Las puntuaciones normalizadas de evaluación y tratamiento fueron más altas para Doctorina (89,4 y 83,7) que para los médicos (66,9 y 61,2).
- Kimi K3 ocupó el siguiente lugar en diagnósticos, mientras que Claude Opus 5 lideró las estimaciones de gestión entre los principales resultados estrechamente espaciados.
Los resultados indican que la ventaja de Doctorina se extiende desde la selección del diagnóstico primario hasta una evaluación diagnóstica y un tratamiento inicial mejor calificados tras una consulta adaptativa.