Talos adalah alat open-source yang mengotomatisasi analisis ulang iteratif data genomik untuk mengidentifikasi diagnosis penyakit langka. Alat ini mencapai tingkat pemulihan diagnosis dalam cakupan sebesar 90% dengan hanya 1,3 varian kandidat per pasien, serta memberikan 241 diagnosis baru di antara 5.000 pasien yang belum terdiagnosis, dengan sebagian besar temuan baru muncul dalam waktu 32 hari sejak publikasi bukti.
Talos: Analisis Ulang Genom Otomatis untuk Diagnosis Penyakit Langka
Rep2Act menyelaraskan representasi VLM untuk meningkatkan abstensi pada benchmark VAD-R baru
Para peneliti memperkenalkan Visual Answerability Diagnosis with Rationales (VAD-R), sebuah benchmark baru yang dirancang untuk mengevaluasi kemampuan model visi-bahasa dalam abstensi dari pertanyaan yang tidak dapat dijawab tanpa petunjuk pintasan. Studi ini mengungkapkan bahwa meskipun keadaan tersembunyi dapat membedakan keterjawaban, model saat ini gagal menerjemahkan hal ini menjadi keputusan eksplisit.
Microsoft merilis RetroChimera untuk prediksi retrosintesis
Microsoft Research telah menerbitkan dan membuka sumber RetroChimera, sebuah kerangka kerja baru untuk prediksi retrosintesis yang menggabungkan dua model komplementer untuk mengusulkan rute sintesis berkualitas tinggi. Sistem ini mengintegrasikan R-SMILES 2, model de-novo berbasis Transformer, dengan NeuralLoc, model berbasis jaringan saraf graf (GNN), menggunakan strategi ensembling terlatih untuk meranking prediksi.
Peneliti mencari satu penilai independen untuk menyelesaikan ambiguitas kesepakatan LLM
Seorang peneliti meminta seorang manusia penilai independen tunggal untuk memberi label pada 100 adegan naratif Turki guna menentukan apakah rendahnya kesepakatan antar-penilai berasal dari sifat interpretatif tugas atau dari definisi anotasi yang kurang spesifik. Studi ini menemukan bahwa empat LLM dan sebuah detektor berbasis aturan sepakat satu sama lain serta dengan referensi manusia pada tingkat kira-kira acak, dengan skor Cohen’s κ berkisar dari 0,000 hingga 0,185.
Studi mengidentifikasi FragileTokens yang gagal dalam penyalinan kontekstual meski lolos uji isolasi
Sebuah studi mengkarakterisasi "FragileTokens," entri kosakata dalam model bahasa bobot terbuka yang berhasil disalin saat terisolasi tetapi menunjukkan kesalahan ketika disisipkan ke dalam teks sekitarnya. Penelitian ini menyoroti bahwa pelestarian identitas literal tidak dijamin oleh uji isolasi standar, karena token dapat dihapus, diganti, atau dipotong di dalam urutan.
Microsoft Research merilis Skala-1.1 dan mengintegrasikannya ke CP2K, Psi4, FHI-aims, ORCA, dan VASP
Microsoft Research telah merilis Skala-1.1, sebuah model teori fungsional kerapatan (DFT) berbasis pembelajaran mendalam yang dilatih dengan data 2,5 kali lebih banyak daripada pendahulunya, mencapai kesalahan rata-rata tertimbang sebesar 2,8 kcal/mol pada benchmark GMTKN55. Perusahaan tersebut secara bersamaan memperluas aksesibilitas dengan menjadikan Skala tersedia di CP2K dan mengintegrasikannya ke Psi4, FHI-aims, ORCA, dan VASP.