Talosは、希少疾患の診断を特定するためにゲノムデータの反復的再解析を自動化するオープンソースツールです。1患者あたりわずか1.3候補変異で範囲内の診断の90%を回復し、5,000人の未診断患者に241件の新たな診断を提供しました。また、新しい発見の大部分は証拠の公開から32日以内に明らかになりました。
Talos: 希少疾患診断のための自動ゲノム再解析
Rep2ActはVAD-Rベンチマークにおける新規 abstention を改善するためにVLM表現を整合させる
研究者たちは、Vision Answerability Diagnosis with Rationales (VAD-R) を導入した。これは、ショートカットの手がかりなしに答えられない質問に対して回答を控えるビジョン言語モデルの能力を評価するために設計された新しいベンチマークである。本研究は、隠れ状態が回答可能性を区別できる一方で、現在のモデルはこの情報を明示的な意思決定に変換できないことを明らかにした。
Microsoft、逆合成予測用のRetroChimeraをリリース
Microsoft Researchは、逆合成予測のための新しいフレームワークであるRetroChimeraを公開し、オープンソース化した。このフレームワークは2つの補完的なモデルを組み合わせて、高品質な合成経路を提案する。システムは、TransformerベースのデノボモデルであるR-SMILES 2と、グラフニューラルネットワーク(GNN)ベースのモデルであるNeuralLocを、学習されたアンサンブル戦略を用いて統合し、予測結果をランク付けする。
研究者、LLMの合意不確実性を解消するため独立した1名の注釈担当者を募集
ある研究者は、タスクの解釈的性質に起因するのか、あるいは注釈定義が未確定であることに起因するのかを判断するために、100のトルコ語物語シーンをラベル付けする単一の独立した人間注釈担当者の依頼を行っている。本研究では、4つのLLMとルールベースの検出器が互いに、かつ人間の参照データとほぼ偶然レベルで合意しており、Cohen’s κスコアは0.000から0.185の範囲であった。
孤立プローブを通過しても文脈コピーに失敗する「FragileTokens」を特定した研究
ある研究は、「FragileTokens」と呼ばれる語彙項目を特徴づけている。これはオープンウェイト言語モデルにおける語彙エントリで、孤立した状態ではコピーに成功するが、周囲のテキスト中に埋め込まれるとエラーを示すものである。この研究は、標準的な孤立テストでは文字通りの同一性の保持が保証されないことを浮き彫りにしている。なぜなら、トークンはシーケンス内で削除されたり、置換されたり、切り詰められたりする可能性があるからである。
Microsoft ResearchがSkala-1.1をリリースし、CP2K、Psi4、FHI-aims、ORCA、VASPに統合
Microsoft Researchは、前作の2.5倍のデータで学習した深層学習密度汎関数理論(DFT)モデルであるSkala-1.1をリリースしました。このモデルはGMTKN55ベンチマークで重み付き平均誤差2.8 kcal/molを達成しています。同社は同時に、SkalaをCP2Kで利用可能にし、Psi4、FHI-aims、ORCA、VASPに統合することでアクセスを拡大しています。