Top 20 minggu ini
lab OpenAI News · 2 hari lalu BrowseComp · 84.36% · 11 tayangan

OpenAI merilis GPT-5.6 untuk alur kerja agen yang terjangkau dan berkinerja tinggi

OpenAI telah meluncurkan keluarga model GPT-5.6, dirancang untuk memberikan kinerja agen tingkat terdepan dengan biaya yang jauh lebih rendah melalui optimasi upaya penalaran dan pengenalan kontrol API baru. Pembaruan ini memungkinkan startup membangun agen yang lebih cepat dan lebih mampu menggunakan model yang lebih kecil seperti Luna dan Terra untuk tugas bervolume tinggi sambil menyimpan model yang lebih besar untuk penilaian kompleks.

lab Google DeepMind Blog · 3 hari lalu · 13 tayangan

Google DeepMind merilis model SL2T penerjemah bahasa isyarat ke teks untuk Gboard dan Live Transcribe

Google DeepMind dan Android telah memperkenalkan SL2T, sebuah model terjemahan bahasa isyarat ke teks (SL2T) yang sangat multibahasa yang membawa AI bahasa isyarat ke produk konsumen untuk pertama kalinya. Teknologi ini menggerakkan dikte dari isyarat ke teks di Gboard dan Live Transcribe pada Pixel 11, dimulai dengan American Sign Language (ASL) ke bahasa Inggris.

lab Google — The Keyword (AI) · 4 hari lalu · 40 tayangan

Google mendemonstrasikan kemampuan konsultasi video klinis waktu nyata dengan AMIE

Google Research dan Google DeepMind telah memajukan sistem AI medis penelitian mereka, AMIE, untuk mendemonstrasikan kemampuan konsultasi video klinis waktu nyata dalam sebuah studi pertama di jenisnya. Dibangun di atas Gemini dan Project Astra menggunakan arsitektur multi-agen, sistem ini menginterpretasikan isyarat visual dan auditori, memandu pemeriksaan fisik virtual, dan melakukan penalaran diagnostik secara waktu nyata.

lab xAI News · 4 hari lalu · 42 tayangan

xAI meluncurkan Grok Bot, agen AI yang selalu aktif untuk desktop dan iOS

xAI telah meluncurkan Grok Bot dalam versi beta, memperkenalkan sistem agen AI yang selalu aktif yang beroperasi di komputer cloud mereka sendiri untuk menangani tugas dari awal hingga akhir. Tersedia hari ini untuk pelanggan SuperGrok Heavy, Cursor Ultra, dan Cursor Teams Premium di desktop dan iOS, bot bekerja lintas aplikasi dan alat tanpa memerlukan pengaturan alur kerja manual.

lab NVIDIA Research · 15 jam lalu · 9 tayangan

HorizonRelight menggunakan self-conditioning termask untuk relighting video jangka panjang yang konsisten

Peneliti mengatasi diskontinuitas temporal dalam relighting video jangka panjang dengan membingkai ulang tugas sebagai terjemahan domain laten bersyarat temporal. Kerangka kerja ini menegakkan kontinuitas antar-chunk dengan menyebarkan latens domain target melintasi batas dan menggunakan self-conditioning domain target termask untuk membuat perilaku ini dapat dipelajari.

lab NVIDIA Research · 15 jam lalu · 10 tayangan

Nvidia menghadirkan FusionRelight untuk pencahayaan ulang potret secara real-time melalui fusi pengetahuan domain hibrida

Peneliti dari Nvidia telah memperkenalkan FusionRelight, sebuah metode untuk pencahayaan ulang potret yang menggabungkan transfer iluminasi yang secara fisik masuk akal dengan pelestarian identitas dan inferensi real-time yang ringkas. Pendekatan ini memanfaatkan Fusi Pengetahuan Domain Hibrida (HDKF), sebuah kerangka pelatihan yang mendistilasi prior fisika, reflektansi, dan realisme dari data sintetis, One-Light-at-a-Time (OLAT), dan di alam liar ke dalam model siswa.

lab OpenAI News · 3 hari lalu · 15 tayangan

OpenAI melaporkan kesenjangan yang melebar seiring pergeseran AI perusahaan dari bantuan ke eksekusi

Dua studi baru OpenAI mengungkapkan bahwa perusahaan terdepan—yang berada di 10% teratas penggunaan AI bulanan—menghasilkan token keluaran per pengguna aktif sebanyak 8,3 kali lebih banyak dibandingkan perusahaan biasa, meningkat dari 2,6 kali pada Januari. Kesenjangan yang melebar ini mencerminkan pergeseran adopsi perusahaan dari penggunaan AI untuk bantuan ke delegasi pekerjaan substansial ke alat agentic seperti Codex dan ChatGPT Work.

lab NVIDIA Research · 3 hari lalu · 40 tayangan

LLM menyamai atau mengalahkan optimisasi Bayesian untuk optimisasi hiperparameter

Sebuah makalah baru mengeksplorasi penggunaan model bahasa besar fundamental (LLM) untuk mengotomatisasi optimisasi hiperparameter (HPO), sebuah proses yang biasanya mengandalkan pendekatan manual dalam pengaturan anggaran terbatas. Para penulis mengembangkan metodologi di mana LLM menyarankan konfigurasi hiperparameter berdasarkan deskripsi dataset dan model, yang kemudian disempurnakan secara iteratif sesuai dengan kinerja model.

lab NVIDIA Research · 3 hari lalu · 40 tayangan

Source memperkenalkan diferensiasi unrolled aproksimasi untuk atribusi data pelatihan

Peneliti memperkenalkan Source, metode atribusi data pelatihan (TDA) baru yang menggabungkan efisiensi komputasi fungsi pengaruh dengan akurasi pendekatan berbasis unrolling. Dengan menggunakan formula mirip fungsi pengaruh untuk mengaproksimasi diferensiasi unrolled, Source mengatasi keterbatasan dalam metode diferensiasi implisit, seperti kegagalan mereka memperhitungkan bias optimisasi atau pipeline multi-tahap.

lab NVIDIA Research · 3 hari lalu · 14 tayangan

NVIDIA merilis model dunia generatif waktu nyata OmniDreams untuk simulasi kendaraan otonom

NVIDIA telah memperkenalkan OmniDreams, sebuah model dunia generatif dasar yang dirancang untuk mengatasi hambatan dalam mengevaluasi kebijakan pengemudi otonom di dalam simulasi loop tertutup. Model ini ditengah- dan pasca-pelatihan dari model difusi Cosmos pada 21k jam skenario berkendara, menghasilkan video secara autoregresif berdasarkan kondisi aksi secara waktu nyata.