Talos는 희귀 질환 진단을 위해 유전체 데이터의 반복적 재분석을 자동화하는 오픈소스 도구입니다. 이 도구는 환자당 평균 1.3개의 후보 변이만으로도 대상 내 진단의 90%를 복원했으며, 진단받지 못한 5,000명의 환자들 사이에서 241건의 새로운 진단을 제공했습니다. 대부분의 새로운 발견은 증거가 출판된 지 32일 이내에 나타났습니다.
Talos: 희귀 질환 진단을 위한 자동화된 유전체 재분석
Rep2Act가 새로운 VAD-R 벤치마크에서 기권 능력을 향상시키기 위해 VLM 표현을 정렬
연구자들은 Visual Answerability Diagnosis with Rationales(VAD-R)이라는 새로운 벤치마크를 소개했으며, 이는 단서 없이 답할 수 없는 질문에 대해 기권하는 능력과 관련된 시각-언어 모델의 성능을 평가하기 위해 설계되었습니다. 연구 결과, 은닉 상태가 답변 가능성을 구분할 수는 있지만 현재 모델들은 이를 명시적인 결정으로 전환하지 못하는 것으로 드러났습니다.
Microsoft가 역합성 예측을 위한 RetroChimera를 출시하다
Microsoft Research는 두 개의 보완적 모델을 결합하여 고품질 합성 경로를 제안하는 새로운 역합성 예측 프레임워크인 RetroChimera를 출판하고 오픈소스로 공개했습니다. 이 시스템은 학습된 앙상블 전략을 사용하여 R-SMILES 2(Transformer 기반의 de-novo 모델)와 NeuralLoc(GNN 기반 모델)을 통합하고 예측을 순위 매깁니다.
연구자가 LLM 간 합의 불명확성을 해결하기 위해 독립적인 한 명의 주석 작성자를 구함
한 연구자는 판독자 간 낮은 일치율이 과제의 해석적 성격에서 비롯된 것인지, 아니면 모호한 주석 정의에서 비롯된 것인지를 파악하기 위해 100개의 터키어 내러티브 장면을 라벨링할 독립적인 인간 주석 작성자 한 명을 요청하고 있습니다. 연구 결과, 네 개의 LLM과 규칙 기반 검출기가 서로 그리고 인간 기준과 약간의 수준으로 일치했으며, Cohen’s κ 점수는 0.000에서 0.185 사이였습니다.
고립 테스트는 통과하지만 문맥적 복사에 실패하는 'FragileTokens'를 식별한 연구
연구는 "FragileTokens"를 특성화했는데, 이는 개방형 가중치 언어 모델의 어휘 항목으로, 고립되었을 때는 성공적으로 복사되지만 주변 텍스트에 삽입되면 오류를 보입니다. 이 연구는 표준 고립 테스트가 문자 그대로의 정체성 보존을 보장하지 않는다고 강조합니다. 시퀀스 내에서 토큰이 삭제, 대체 또는 잘릴 수 있기 때문입니다.
Microsoft Research, Skala-1.1 출시 및 CP2K, Psi4, FHI-aims, ORCA, VASP 통합
Microsoft Research는 전작보다 2.5배 더 많은 데이터로 학습된 딥러닝 밀도범함수이론(DFT) 모델인 Skala-1.1을 출시했으며, GMTKN55 벤치마크에서 가중 평균 오차 2.8 kcal/mol을 달성했습니다. 동사는 Skala를 CP2K에서 사용 가능하게 하고 Psi4, FHI-aims, ORCA, VASP에 통합함으로써 접근성을 확대하고 있습니다.