Topik · Research paper
lab OpenAI News · 22 hari lalu · 31 tayangan

Sistem internal OpenAI membuktikan persamaan Navier–Stokes dapat mengembangkan singularitas dalam waktu terbatas

OpenAI melaporkan bahwa sistem AI internal telah menghasilkan bukti yang menunjukkan bahwa dinamika persamaan Navier-Stokes untuk gerakan fluida dapat mengembangkan singularitas dalam waktu terbatas. Solusi, yang diturunkan oleh sistem multi-agen yang didukung oleh model yang secara signifikan lebih mampu daripada GPT-6 Astra, menetapkan pernyataan "C" dari formulasi Hadiah Millennium.

lab Anthropic News · 7 hari lalu · 40 tayangan

Claude dari Anthropic menemukan sistem enzim ART baru pada bakteriofag

Anthropic telah mengumumkan pembentukan kelompok penelitian ilmu kehidupan baru yang berdedikasi untuk memanfaatkan Claude guna mengidentifikasi famili protein yang belum berkarakterisasi dan menguji hipotesis melalui eksperimen laboratorium. Dalam hasil awal, AI tersebut secara otonom menemukan sistem enzim baru bernama reverse transcriptase terkait array (ART) yang ditemukan pada bakteriofag.

lab Microsoft Research Blog · 9 hari lalu · 62 tayangan

Microsoft merilis RetroChimera untuk prediksi retrosintesis

Microsoft Research telah menerbitkan dan membuka sumber RetroChimera, sebuah kerangka kerja baru untuk prediksi retrosintesis yang menggabungkan dua model komplementer untuk mengusulkan rute sintesis berkualitas tinggi. Sistem ini mengintegrasikan R-SMILES 2, model de-novo berbasis Transformer, dengan NeuralLoc, model berbasis jaringan saraf graf (GNN), menggunakan strategi ensembling terlatih untuk meranking prediksi.

lab Google DeepMind Blog · 27 hari lalu · 44 tayangan

Google DeepMind merilis WeatherNext 3, model AI cuaca global dengan resolusi hingga 5km

Google DeepMind dan Google Research telah memperkenalkan WeatherNext 3, sebuah model AI cuaca global canggih yang menghasilkan prakiraan per jam pada resolusi spasial tinggi dengan belajar langsung dari pengamatan satelit waktu nyata. Pembaruan ini menyediakan prakiraan sekitar lima kali lebih tajam dibandingkan pendahulunya, WeatherNext 2, memungkinkan prediksi yang lebih terlokalisasi untuk peristiwa cuaca kritis.

media Latent Space · 21 hari lalu · 29 tayangan

OpenAI klaim hasil singularitas Navier-Stokes yang dibantu AI menggunakan 10.000 agen

Akun-akun yang berafiliasi dengan OpenAI melaporkan bahwa upaya yang dibantu oleh AI menghasilkan temuan terkait masalah keberadaan dan keteraturan Navier-Stokes, salah satu dari Millennium Prize Problems. Klaim tersebut menyatakan bahwa sekitar 10.000 agen berkolaborasi dalam tugas ini setelah dilatih selama kira-kira satu tahun menggunakan pembelajaran penguatan multi-agen.

arxiv arXiv cs.LG · 28 hari lalu · 73 tayangan

Model Nemotron-3 dari NVIDIA meraih skor emas dan skor di atas manusia dalam IOI 2026

Para peneliti telah mengembangkan pipeline pasca-pelatihan untuk model bahasa besar yang memungkinkan mereka mencapai kinerja tingkat medali emas dalam pemrograman kompetitif. Dengan menggabungkan penyetelan halus terawasi, pembelajaran penguatan, dan strategi baru berbasis umpan balik bernama GenCorrect, sistem ini mengungguli para kontestan manusia terbaik pada kumpulan soal IOI 2026.

arxiv arXiv cs.CL · 28 hari lalu · 35 tayangan

Model Nemotron-3 NVIDIA meraih kinerja medali emas dalam kompetisi coding IOI

NVIDIA telah mengembangkan pipeline pasca-pelatihan untuk model bahasa Nemotron-3-Nano-CC dan Nemotron-3-Ultra-CC-nya agar unggul dalam pemrograman kompetitif. Dengan menggabungkan kurasi masalah skala besar, jejak penalaran sintetis, penyetelan halus terawasi (supervised fine-tuning), dan pembelajaran penguatan, tim tersebut menciptakan sistem khusus yang mampu melakukan penalaran algoritmik tingkat tinggi.

arxiv arXiv cs.AI · 1 hari lalu · 1 tayangan

RareDx menggunakan optimasi kebijakan berbasis graf untuk meningkatkan diagnosis penyakit langka

Para penulis memperkenalkan RareDx, sebuah sistem yang menggabungkan penggunaan bukti terkontrol dengan optimasi kebijakan berbasis grafik pengetahuan untuk mengatasi masalah penalaran long-tail dalam diagnosis penyakit langka. Pipeline pelatihan menggabungkan Top-10 pasca-pelatihan dengan RareDx-KGPO, yang memproyeksikan prediksi ke dalam grafik penyakit kanonik dan mengintegrasikan relevansi bertingkat yang dikurasi, kedekatan ontologi, kesamaan biomedis, dan konsistensi fenotipe.

arxiv arXiv cs.CL · 2 hari lalu · 1 tayangan

Rep2Act menyelaraskan representasi VLM untuk meningkatkan abstensi pada benchmark VAD-R baru

Para peneliti memperkenalkan Visual Answerability Diagnosis with Rationales (VAD-R), sebuah benchmark baru yang dirancang untuk mengevaluasi kemampuan model visi-bahasa dalam abstensi dari pertanyaan yang tidak dapat dijawab tanpa petunjuk pintasan. Studi ini mengungkapkan bahwa meskipun keadaan tersembunyi dapat membedakan keterjawaban, model saat ini gagal menerjemahkan hal ini menjadi keputusan eksplisit.

arxiv arXiv cs.AI · 3 hari lalu · 15 tayangan

Highlight-Then-Summarize memadatkan bukti untuk meningkatkan pemahaman konteks panjang

Para peneliti mengusulkan Highlight-Then-Summarize (H2S), sebuah paradigma kompresi-terus-alasan yang mengidentifikasi bukti relevan dengan pertanyaan dan mengintegrasikannya ke dalam ringkasan kompak sebelum menghasilkan jawaban. Tim membangun H2S-Dataset dengan 6.647 contoh dan memperkenalkan H2S-RL untuk memberikan imbalan tingkat proses untuk pemilihan bukti.

arxiv arXiv cs.CL · 3 hari lalu · 6 tayangan

Highlight-Then-Summarize memadatkan bukti untuk pemahaman konteks panjang yang lebih baik

Para peneliti mengusulkan Highlight-Then-Summarize (H2S), sebuah paradigma kompresi-terus-alasan yang mengidentifikasi bukti relevan dengan pertanyaan dan mengintegrasikannya ke dalam ringkasan kompak sebelum menghasilkan jawaban. Untuk mendukung pendekatan ini, tim membangun H2S-Dataset dengan 6.647 contoh dari 11 keluarga benchmark dan memperkenalkan H2S-RL untuk imbalan tingkat proses.

media Hugging Face Forums · 3 hari lalu · 4 tayangan

Hung Tran mengidentifikasi jebakan kliping pada kodek gambar neural yang overfitted

Hung Tran, seorang mahasiswa magister di Universitas Teknologi Informasi (VNU-HCM), telah menerbitkan kode dan data untuk makalahnya "The Clipping Trap: A Silent Failure Mode in Overfitted Neural Image Codecs." Karya ini menyoroti bagaimana kodek yang overfitted seperti Cool-chic dan C3 dapat menghasilkan gambar warna datar dengan gradien distorsi nol pada jenis konten tertentu.