Topik · Research paper
lab Google DeepMind Blog · 8 hari lalu · 27 tayangan

Google DeepMind merilis model AI WeatherNext untuk prakiraan siklon secara sumber terbuka

Google DeepMind dan Google Research telah merilis model AI WeatherNext 2 dan WeatherNext Cyclones secara sumber terbuka, yang mencapai akurasi terbaik dalam memprediksi lintasan, intensitas, dan struktur angin siklon tropis. Dipublikasikan di Nature, penelitian ini menunjukkan bahwa model-model ini memberikan prakirawan tambahan satu hari akurasi prediktif dibandingkan sistem sebelumnya.

lab OpenAI News · 14 hari lalu · 23 tayangan

Model Astra memecahkan sepuluh masalah terbuka dalam matematika dan ilmu komputer teoretis

Model internal Astra dari OpenAI telah menghasilkan solusi untuk sepuluh masalah terbuka yang telah berlangsung lama di bidang matematika dan ilmu komputer teoretis, dengan argumen yang diformalisasi dalam Lean. Hasil-hasil ini mencakup geometri berdimensi tinggi, teori pengkodean, teori grup, dan kompleksitas kuantum, menjawab pertanyaan-pertanyaan yang tidak menunjukkan kemajuan selama setidaknya satu dekade.

lab NVIDIA Research · 5 jam lalu · 1 tayangan

HorizonRelight menggunakan self-conditioning termask untuk relighting video jangka panjang yang konsisten

Peneliti mengatasi diskontinuitas temporal dalam relighting video jangka panjang dengan membingkai ulang tugas sebagai terjemahan domain laten bersyarat temporal. Kerangka kerja ini menegakkan kontinuitas antar-chunk dengan menyebarkan latens domain target melintasi batas dan menggunakan self-conditioning domain target termask untuk membuat perilaku ini dapat dipelajari.

lab NVIDIA Research · 3 hari lalu · 38 tayangan

LLM menyamai atau mengalahkan optimisasi Bayesian untuk optimisasi hiperparameter

Sebuah makalah baru mengeksplorasi penggunaan model bahasa besar fundamental (LLM) untuk mengotomatisasi optimisasi hiperparameter (HPO), sebuah proses yang biasanya mengandalkan pendekatan manual dalam pengaturan anggaran terbatas. Para penulis mengembangkan metodologi di mana LLM menyarankan konfigurasi hiperparameter berdasarkan deskripsi dataset dan model, yang kemudian disempurnakan secara iteratif sesuai dengan kinerja model.

lab NVIDIA Research · 3 hari lalu · 40 tayangan

Source memperkenalkan diferensiasi unrolled aproksimasi untuk atribusi data pelatihan

Peneliti memperkenalkan Source, metode atribusi data pelatihan (TDA) baru yang menggabungkan efisiensi komputasi fungsi pengaruh dengan akurasi pendekatan berbasis unrolling. Dengan menggunakan formula mirip fungsi pengaruh untuk mengaproksimasi diferensiasi unrolled, Source mengatasi keterbatasan dalam metode diferensiasi implisit, seperti kegagalan mereka memperhitungkan bias optimisasi atau pipeline multi-tahap.

lab NVIDIA Research · 3 hari lalu · 10 tayangan

NVIDIA merilis model dunia generatif waktu nyata OmniDreams untuk simulasi kendaraan otonom

NVIDIA telah memperkenalkan OmniDreams, sebuah model dunia generatif dasar yang dirancang untuk mengatasi hambatan dalam mengevaluasi kebijakan pengemudi otonom di dalam simulasi loop tertutup. Model ini ditengah- dan pasca-pelatihan dari model difusi Cosmos pada 21k jam skenario berkendara, menghasilkan video secara autoregresif berdasarkan kondisi aksi secara waktu nyata.

lab Microsoft Research Blog · 3 hari lalu · 11 tayangan

Microsoft Research memperkenalkan CARE-X, VLM rontgen dada terpadu dengan supervisi tambahan dan pengukuran yang diperkaya alat

Microsoft Research telah memperkenalkan CARE-X, sebuah model penelitian yang dirancang untuk mengatasi kesenjangan dalam model bahasa-visi radiologi saat ini dengan menggabungkan penulisan laporan generatif dengan prediksi diagnostik yang terkali. Sistem ini menggunakan pembelajaran penguatan (DAPO) untuk memberi hadiah pada kebenaran klinis dan memadukan model Qwen3-VL-4B-Instruct dengan alat pengukuran deterministik untuk mengevaluasi kinerja pada kondisi yang memerlukan perhitungan presisi.

lab NVIDIA Research · 4 hari lalu · 14 tayangan

DSTP meredam kegagalan pemangkasan token visual dalam penalaran MLLM yang kompleks

Peneliti mengidentifikasi Pergeseran Informasi Visual Relevan (RVIS) selama dekoding sebagai penyebab utama kegagalan metode pemangkasan token visual yang ada pada Model Bahasa Besar Multimodal (MLLM). Untuk mengatasi hal ini, mereka mengusulkan Pemangkasan Token Sadar Pergeseran Tahap Dekoding (DSTP), sebuah kerangka kerja tanpa pelatihan yang menyelaraskan token visual dengan persyaratan penalaran yang berubah.

lab NVIDIA Research · 4 hari lalu · 9 tayangan

ZPPO menggunakan prompt alih-alih gradien untuk meningkatkan pelatihan model visi-bahasa kecil

Para peneliti memperkenalkan Zone of Proximal Policy Optimization (ZPPO), sebuah metode yang menyuntikkan pengetahuan guru ke dalam prompt daripada gradien kebijakan untuk mengatasi kerapuhan dalam distilasi pengetahuan dan pergeseran dalam pembelajaran penguatan. ZPPO membangun Binary Candidate-included Questions (BCQ) dan Negative Candidate-included Questions (NCQ) untuk pertanyaan sulit, dan memutar ulang pertanyaan tersebut melalui buffer replays hingga akurasi siswa meningkat atau pertanyaan tersebut dihapus.

lab NVIDIA Research · 4 hari lalu

Hide to See memperkenalkan masking prefix penalaran untuk distilasi VLM

Peneliti mengusulkan kerangka kerja distilasi pikir-jawab baru yang meningkatkan kemampuan model bahasa-visi kompak untuk memanfaatkan bukti visual dengan melakukan masking pada prefix penalaran yang menonjol. Pendekatan ini mengatasi masalah "pelupakan visual" yang umum terjadi pada jejak pikir-jawab panjang, di mana siswa kehilangan fokus pada petunjuk visual selama penalaran yang diperpanjang.

lab NVIDIA Research · 4 hari lalu · 1 tayangan

SpatialClaw menggunakan kode sebagai antarmuka aksi untuk penalaran spasial agentic

Peneliti mengusulkan SpatialClaw, sebuah framework tanpa pelatihan yang mengadopsi kode sebagai antarmuka aksi untuk meningkatkan penalaran spasial terbuka 3D dan 4D dalam model visi-bahasa. Berbeda dengan agen yang ada yang mengandalkan eksekusi satu-lewat atau panggilan alat yang kaku, SpatialClaw mempertahankan kernel Python stateful yang telah dimuat sebelumnya dengan frame input dan primitif persepsi.