Open weights
lab Microsoft Research Blog · 2 hari lalu · 29 tayangan

Microsoft merilis RetroChimera untuk prediksi retrosintesis

Microsoft Research telah menerbitkan dan membuka sumber RetroChimera, sebuah kerangka kerja baru untuk prediksi retrosintesis yang menggabungkan dua model komplementer untuk mengusulkan rute sintesis berkualitas tinggi. Sistem ini mengintegrasikan R-SMILES 2, model de-novo berbasis Transformer, dengan NeuralLoc, model berbasis jaringan saraf graf (GNN), menggunakan strategi ensembling terlatih untuk meranking prediksi.

lab Hugging Face Blog · 2 hari lalu MMLU · 77.0% · 15 tayangan

Multiverse merumuskan ulang penghapusan blok LLM sebagai optimasi Ising untuk kompresi mendalam

Multiverse telah merilis makalah yang mendetailkan metode yang membingkai ulang pemangkasan model bahasa besar sebagai masalah optimasi biner terkendali yang dipetakan ke kaca Ising. Dengan memperlakukan blok transformer sebagai spin dengan kopling berpasangan yang diturunkan dari Hessian kerugian, pendekatan ini mengidentifikasi konfigurasi penghapusan blok optimal tanpa memerlukan benchmarking iteratif.

lab Tencent Hunyuan (HF) · 6 hari lalu · 64 tayangan

Tencent merilis WeVisDoc-4B, parser dokumen end-to-end

Tencent telah merilis WeVisDoc-4B, sebuah parser dokumen end-to-end untuk gambar halaman yang mengonversi halaman menjadi Markdown terstruktur dengan rumus LaTeX dan tabel HTML. Difo-tune dari Qwen3-VL-4B-Instruct, model ini mencapai skor keseluruhan 95.38 di OmniDocBench v1.6 dan berada di peringkat pertama di antara parser yang dibandingkan dalam semua empat pengaturan yang dilaporkan.

media Together AI Blog · 7 hari lalu · 16 tayangan

Together menguraikan strategi migrasi dari model sumber tertutup ke sumber terbuka

Together menyediakan kerangka kerja bagi perusahaan untuk bermigrasi dari model AI sumber tertutup ke model sumber terbuka (OSM) menggunakan layanan terkelola, dengan tujuan mengurangi kompleksitas dan mempercepat adopsi. Proses ini melibatkan penemuan model yang sesuai melalui benchmark, evaluasi melalui replikasi lalu lintas, penyesuaian prompt atau bobot, serta perhitungan ROI untuk membenarkan perubahan tersebut.