Talos est un outil open-source qui automatise la réanalyse itérative des données génomiques afin d'identifier les diagnostics de maladies rares. Il a atteint un taux de récupération de 90 % des diagnostics dans le périmètre avec seulement 1,3 variants candidats par patient, et a fourni 241 nouveaux diagnostics parmi 5 000 patients non diagnostiqués, la plupart des nouvelles découvertes apparaissant dans les 32 jours suivant la publication des preuves.
Talos : Réanalyse génomique automatisée pour le diagnostic des maladies rares
Rep2Act aligne les représentations des VLM pour améliorer l'abstention sur le nouveau benchmark VAD-R
Les chercheurs présentent Visual Answerability Diagnosis with Rationales (VAD-R), un nouveau benchmark conçu pour évaluer la capacité des modèles vision-langage à s'abstenir de répondre aux questions sans réponse, sans se fier à des indices de raccourci. L'étude révèle que si les états cachés peuvent distinguer l'accessibilité de la réponse, les modèles actuels échuent à traduire cela en décisions explicites.
Microsoft publie RetroChimera pour la prédiction de rétrosynthèse
Microsoft Research a publié et open-sourcé RetroChimera, un nouveau cadre de prédiction de rétrosynthèse qui combine deux modèles complémentaires pour proposer des voies de synthèse de haute qualité. Le système intègre R-SMILES 2, un modèle de novo basé sur Transformer, avec NeuralLoc, un modèle basé sur un réseau neuronal graphique (GNN), en utilisant une stratégie d'assemblage apprise pour classer les prédictions.
Un chercheur sollicite un seul annotateur indépendant pour lever l'ambiguïté de l'accord des LLM
Un chercheur demande à un seul annotateur humain indépendant d'étiqueter 100 scènes narratives turques afin de déterminer si le faible accord inter-évaluateurs provient du caractère interprétatif de la tâche ou de définitions d'annotation mal précisées. L'étude a révélé que quatre LLM et un détecteur basé sur des règles étaient en accord entre eux et avec la référence humaine à un niveau proche du hasard, les scores de κ de Cohen variant de 0,000 à 0,185.
Une étude identifie des FragileTokens qui échouent à la copie contextuelle malgré le passage des tests d'isolation
Une étude caractérise les « FragileTokens », entrées de vocabulaire dans les modèles de langage à poids ouverts qui copient avec succès lorsqu'ils sont isolés mais présentent des erreurs lorsqu'ils sont intégrés dans un texte environnant. La recherche souligne que la préservation littérale de l'identité n'est pas garantie par les tests d'isolation standards, car les tokens peuvent être supprimés, substitués ou tronqués au sein de séquences.
Microsoft Research publie Skala-1.1 et l'intègre dans CP2K, Psi4, FHI-aims, ORCA et VASP
Microsoft Research a publié Skala-1.1, un modèle de théorie de la fonctionnelle de la densité (DFT) par apprentissage profond entraîné sur 2,5 fois plus de données que son prédécesseur, atteignant une erreur moyenne pondérée de 2,8 kcal/mol sur le benchmark GMTKN55. L'entreprise élargit simultanément l'accès en rendant Skala disponible dans CP2K et en l'intégrant dans Psi4, FHI-aims, ORCA et VASP.