Um estudo comparou o sistema de IA clínica Doctorina com oito médicos e quatro modelos de linguagem fronteira autônomos em 150 consultas sintéticas de atenção primária em polonês.

  • Doctorina alcançou concordância diagnóstica Top-1 de 82,0%, superando significativamente o desempenho de 57,0% dos médicos.
  • O sistema de IA atingiu concordância com o diferencial primário ou de referência de 97,3% em comparação com 85,0% para os doutores.
  • As pontuações normalizadas de trabalho e tratamento foram mais altas para Doctorina (89,4 e 83,7) do que para os médicos (66,9 e 61,2).
  • Kimi K3 ficou em seguida no diagnóstico, enquanto Claude Opus 5 liderou as estimativas de gestão entre os principais resultados próximos.

Os resultados indicam que a vantagem da Doctorina se estende desde a seleção do diagnóstico primário até um trabalho diagnóstico e tratamento inicial melhor avaliados após consulta adaptativa.