Talos es una herramienta de código abierto que automatiza el reanálisis iterativo de datos genómicos para identificar diagnósticos de enfermedades raras. Logró una tasa de recuperación del 90% de los diagnósticos dentro del alcance con solo 1,3 variantes candidatas por paciente, y proporcionó 241 nuevos diagnósticos en 5.000 pacientes sin diagnóstico, con la mayoría de los nuevos hallazgos emergiendo dentro de los 32 días posteriores a la publicación de la evidencia.
Talos: Reanálisis genómico automatizado para el diagnóstico de enfermedades raras
Estabilización de la intención de herramientas en RAG en streaming
Un estudio mide la estabilización de la intención de herramientas en RAG en streaming, definiendo cuándo las consultas de herramientas especulativas convergen a respuestas correctas. En el benchmark CRAG, el 73.9% de las consultas permiten ocultar latencia sustancial, con estabilización temprana observada en preguntas con evidencia recuperable literalmente. El tipo de pregunta predice significativamente la estabilización temprana frente a la tardía, informando cuándo los disparadores especulativos son efectivos.
Microsoft Research presenta CARE-X, un VLM unificado de radiografías de tórax con supervisión auxiliar y medición aumentada por herramientas
Microsoft Research ha presentado CARE-X, un modelo de investigación diseñado para abordar las lagunas en los actuales modelos de visión-lenguaje de radiología al combinar la generación de informes generativos con predicciones diagnósticas calibradas. El sistema utiliza aprendizaje por refuerzo (DAPO) para recompensar la corrección clínica y empareja el modelo Qwen3-VL-4B-Instruct con herramientas de medición deterministas para evaluar el rendimiento en condiciones que requieren cálculos precisos.
GPT-5 y GPT-5 Nano igualan a expertos en la evaluación de investigaciones sobre oncogénesis microbiana
Un estudio demuestra que GPT-5 y GPT-5 Nano logran un rendimiento de nivel experto en la extracción de evidencia y la evaluación crítica de publicaciones de investigación sobre oncogénesis microbiana. Los investigadores evaluaron estos modelos junto con Gemini 2.5 Pro y Gemini 2.5 Flash frente a expertos del dominio utilizando un conjunto de datos de 24 artículos centrados en MMTV-LV y cáncer de mama.
GPT-5 y GPT-5 Nano igualan a expertos en la extracción de evidencia sobre oncogénesis microbiana
Un estudio que evalúa modelos de lenguaje grandes en la síntesis sistemática de evidencia para la oncogénesis microbiana encontró que GPT-5 y GPT-5 Nano se desempeñan de manera indistinguible de los expertos del dominio. Los investigadores evaluaron Gemini 2.5 Pro, Gemini 2.5 Flash, GPT-5 y GPT-5 Nano en 24 artículos de investigación utilizando una plantilla estructurada de 77 elementos a través de múltiples tipos de preguntas.
M$^3$R-Bench presenta un benchmark fundamentado en evidencia para la comprensión de metáforas multimodales
Los investigadores presentan M$^3$R-Bench, un benchmark unificado que contiene 1.000 instancias de imagen-texto con anotaciones verificadas por humanos diseñadas para evaluar la comprensión de metáforas multimodales fundamentadas en evidencia. El benchmark proporciona anotaciones conjuntas para la ocurrencia de metáforas, el mapeo Objetivo-Fuente, el sentimiento y explicaciones por etapas basadas en la Teoría de las Metáforas Conceptuales.