Talos 是一款开源工具,可自动化地对基因组数据进行迭代重分析,以识别罕见病诊断。它在每位患者仅产生 1.3 个候选变异的情况下,实现了 90% 的目标内诊断恢复率,并为 5,000 名未确诊患者提供了 241 例新诊断,其中大多数新发现出现在证据发表后的 32 天内。
lab
Microsoft Research Blog
·
98 天前
·
research
Talos:罕见病诊断的自动化基因组重分析
译自 English → 中文
相关文章
arxiv
arXiv cs.CL
·
2 天前
·
1 次浏览
Rep2Act对齐VLM表示以在新VAD-R基准上提升拒答能力
研究人员引入了带有理由的视觉可答性诊断(Visual Answerability Diagnosis with Rationales,VAD-R),这是一个新基准,旨在评估视觉-语言模型在不依赖捷径线索的情况下拒绝回答不可回答问题(unanswerable questions)的能力。研究表明,虽然隐藏状态能够区分问题的可答性,但当前模型未能将这种能力转化为明确的决策。
lab
Microsoft Research Blog
·
9 天前
·
62 次浏览
微软发布用于逆合成预测的RetroChimera
微软研究院已发布并开源了RetroChimera,这是一个用于逆合成预测的新框架,它结合了两个互补模型以提出高质量的合成路线。该系统将基于Transformer的从头生成模型R-SMILES 2与基于图神经网络(GNN)的NeuralLoc模型相结合,采用一种学习到的集成策略对预测结果进行排序。
media
Hugging Face Forums
·
10 天前
·
22 次浏览
研究者寻求一名独立标注员以解决LLM协议歧义
一位研究者请求一名独立的真人标注员对100个土耳其语叙事场景进行标注,以确定低评分者间一致性是源于任务的解释性本质,还是由于标注定义不明确。研究发现,四个大型语言模型和一个基于规则的检测器彼此之间以及与人类参考标准的一致性大致处于随机水平,Cohen’s κ得分范围在0.000到0.185之间。
media
Hugging Face Forums
·
17 天前
·
29 次浏览
研究识别出在通过隔离探针后仍无法进行上下文复制的脆弱标记
一项研究对“脆弱标记”进行了刻画,这些是开放权重语言模型中的词汇条目,它们在孤立时能够成功复制,但在嵌入周围文本时会表现出错误。该研究强调,标准隔离测试并不能保证字面身份的保留,因为标记在序列中可能会被删除、替换或截断。
lab
Microsoft Research Blog
·
41 天前
·
56 次浏览
微软研究院发布Skala-1.1并将其集成至CP2K、Psi4、FHI-aims、ORCA和VASP
微软研究院发布了Skala-1.1,这是一种深度学习密度泛函理论(DFT)模型,其训练数据量是前代的2.5倍,在GMTKN55基准测试中实现了2.8 kcal/mol的加权平均误差。该公司同时通过使Skala可在CP2K中使用,并将其集成到Psi4、FHI-aims、ORCA和VASP中来扩大访问范围。