Topik · Open weights
lab Microsoft Research Blog · 9 hari lalu · 62 tayangan

Microsoft merilis RetroChimera untuk prediksi retrosintesis

Microsoft Research telah menerbitkan dan membuka sumber RetroChimera, sebuah kerangka kerja baru untuk prediksi retrosintesis yang menggabungkan dua model komplementer untuk mengusulkan rute sintesis berkualitas tinggi. Sistem ini mengintegrasikan R-SMILES 2, model de-novo berbasis Transformer, dengan NeuralLoc, model berbasis jaringan saraf graf (GNN), menggunakan strategi ensembling terlatih untuk meranking prediksi.

lab Hugging Face Blog · 1 hari lalu · 8 tayangan

NVIDIA merilis model dasar Kumo Tabular terbuka untuk prediksi tabel tanpa pelatihan

NVIDIA telah merilis Kumo Tabular, sebuah model dasar terbuka untuk klasifikasi dan regresi tabel yang beroperasi melalui pembelajaran dalam konteks tanpa memerlukan pelatihan atau rekayasa fitur. Dilatih secara eksklusif pada data buatan yang dihasilkan oleh Model Kausal Struktural, model ini tersedia dalam tiga ukuran dengan jumlah parameter berkisar dari 28M hingga 215M.

media MarkTechPost · 20 hari lalu · 55 tayangan

DeepSeek merilis DeepSeek-V4.1-Flash dengan konteks 1M dan cache KV FP4

DeepSeek AI telah merilis DeepSeek-V4.1-Flash, sebuah model Mixture-of-Experts multimodal yang dilengkapi jendela konteks 1 juta token dan cache KV FP4 yang mengurangi jejak cache global menjadi 890 byte per token. Model ini memanfaatkan arsitektur encoder-decoder kausal dan Compressed Sparse Attention 2 (CSA2) untuk secara signifikan menurunkan kebutuhan memori sambil mempertahankan kinerja.

media MarkTechPost · 1 hari lalu Android World · 85.1% · 8 tayangan

H Company merilis model penggunaan komputer berbobot terbuka Holo4 untuk desktop, web, dan mobile

H Company telah merilis Holo4, sebuah keluarga model visi-bahasa umum untuk penggunaan komputer yang dirancang untuk mengklik, mengetik, menulis kode, dan memanggil alat di lingkungan desktop, web, Android, dan API. Rilis ini mencakup dua ukuran model: Holo4 27B (dense) dan Holo4 35B-A3B (Mixture of Experts dengan 3B parameter aktif), keduanya mendukung jendela konteks 256K.

media Hugging Face Forums · 6 hari lalu GPQA Diamond · 93.94% · 22 tayangan

VeriLoop E2: Model pasca-pelatihan 27B dengan tangga GGUF dari BF16 ke IQ1_M

Lab Robot SIGS Tsinghua telah merilis VeriLoop E2, sebuah model pasca-pelatihan 27B yang dibangun di atas Qwen3.8-27B untuk kode yang dapat diverifikasi, matematika, dan penalaran ilmiah. Rilis ini memperkenalkan VeriLoop-Governed Recurrence (VGR), yang memisahkan generasi dari verifikasi eksternal untuk memastikan transisi keadaan secara ketat meningkatkan dimensi bukti.