Un estudio sobre 126 pacientes de BraTS21 encuentra que, aunque MC Dropout logra una fuerte alineación entre incertidumbre y error, falla en detectar problemas críticos de calibración en las regiones de tumor realzante. El modelo UNet-Res muestra entropia cercana a cero y ECE alto en estas áreas clínicamente vitales, con un puntaje Dice bajo de 0.714, lo que indica una severa descualibración invisible para métricas estándar como Dice y AUROC. Estos resultados destacan que la alineación de incertidumbre por sí sola es insuficiente para la seguridad clínica y que la calibración específica por región debe evaluarse junto con las métricas estándar.