Sumber · Hugging Face Blog
lab Hugging Face Blog · 1 hari lalu · 8 tayangan

NVIDIA merilis model dasar Kumo Tabular terbuka untuk prediksi tabel tanpa pelatihan

NVIDIA telah merilis Kumo Tabular, sebuah model dasar terbuka untuk klasifikasi dan regresi tabel yang beroperasi melalui pembelajaran dalam konteks tanpa memerlukan pelatihan atau rekayasa fitur. Dilatih secara eksklusif pada data buatan yang dihasilkan oleh Model Kausal Struktural, model ini tersedia dalam tiga ukuran dengan jumlah parameter berkisar dari 28M hingga 215M.

lab Hugging Face Blog · 1 hari lalu · 1 tayangan

ProvenanceGuard menambahkan verifikasi sadar sumber ke agen MCP

ProvenanceGuard adalah lapisan verifikasi pasca-pembuatan untuk agen Model Context Protocol (MCP) yang mendeteksi penggabungan lintas-sumber dengan memastikan klaim dikaitkan ke sumber bukti yang benar. Sistem ini menganalisis jejak MCP yang ditangkap tanpa melatih ulang agen, memecah jawaban menjadi klaim dan memverifikasi bahwa sumber pendukung cocok dengan yang dinamakan atau tersirat dalam output.

lab Hugging Face Blog · 6 hari lalu · 13 tayangan

Liquid AI merilis LFM2.5-VL-DSpark untuk mempercepat inferensi model visi-bahasa

Liquid AI telah merilis model draf LFM2.5-VL-DSpark, sebuah drafter decoding spekulatif yang dirancang untuk mempercepat inferensi bagi model visi-bahasa LFM2.5-VL-3B. Drafter ini menangkap keadaan tersembunyi dari lapisan tetap pada model target untuk menghasilkan token kandidat, hanya menambahkan 280M parameter (overhead 8,9%) sambil mempertahankan dimensi yang identik di seluruh modalitas.

lab Hugging Face Blog · 7 hari lalu · 16 tayangan

NVIDIA Warp dan MjWarp memungkinkan simulasi robotika paralel yang dipercepat GPU

MuJoCo Warp (MJWarp), dibangun di atas NVIDIA Warp, memungkinkan model MuJoCo yang kompatibel berjalan pada skala GPU, sehingga memungkinkan pengembangan ratusan atau ribuan dunia simulasi independen dalam satu panggilan. Arsitektur ini menggeser fokus dari meminimalkan latensi untuk satu lingkungan ke meningkatkan throughput agregat, yang menguntungkan pembelajaran penguatan dan pengambilan sampel skala besar.

lab Hugging Face Blog · 7 hari lalu · 27 tayangan

NVIDIA merilis model penandaan pembicara Nemotron 3 Diarization berbobot terbuka

NVIDIA telah merilis Nemotron 3 Diarization, sebuah model berbobot terbuka dengan 100 juta parameter untuk penandaan pembicara secara real-time yang mendukung hingga delapan pembicara. Model ini menempati peringkat #1 di papan peringkat Diarization-Bench VoiceArena dengan Tingkat Kesalahan Penandaan (DER) sebesar 14,72%, mengungguli sistem berikutnya dengan pengurangan relatif sekitar 24%.

lab Hugging Face Blog · 8 hari lalu · 25 tayangan

AISI merilis hasil evaluasi terverifikasi untuk enam model terdepan pada lima benchmark

Institut Keamanan AI Inggris (AISI) telah membuat metode dan temuan evaluasi yang dilaporkan secara publik tersedia melalui platform Kartu Evaluasi EvalEval untuk meningkatkan reproduktibilitas benchmark. Rilis ini mencakup hasil terverifikasi, konteks, dan informasi konfigurasi untuk lima benchmark spesifik: HealthBench, FrontierMath, Humanity's Last Exam, SWE-Bench Pro, dan Terminal-Bench 2.0.

lab Hugging Face Blog · 9 hari lalu MMLU · 77.0% · 17 tayangan

Multiverse merumuskan ulang penghapusan blok LLM sebagai optimasi Ising untuk kompresi mendalam

Multiverse telah merilis makalah yang mendetailkan metode yang membingkai ulang pemangkasan model bahasa besar sebagai masalah optimasi biner terkendali yang dipetakan ke kaca Ising. Dengan memperlakukan blok transformer sebagai spin dengan kopling berpasangan yang diturunkan dari Hessian kerugian, pendekatan ini mengidentifikasi konfigurasi penghapusan blok optimal tanpa memerlukan benchmarking iteratif.

lab Hugging Face Blog · 15 hari lalu · 20 tayangan

ALTK-Evolve memperkenalkan pedoman konsistensi untuk mengurangi kesenjangan keandalan agen

Para peneliti telah memperkenalkan "pedoman konsistensi" dalam sistem ALTK-Evolve, sebuah mekanisme baru yang dirancang untuk mengatasi variabilitas kinerja agen LLM yang sering disembunyikan oleh metrik akurasi rata-rata standar. Dengan mengidentifikasi dan menstabilkan titik-titik keputusan yang rentan terhadap perubahan, pendekatan ini secara signifikan meningkatkan konsistensi keberhasilan tugas tanpa mengorbankan kemampuan keseluruhan.

lab Hugging Face Blog · 16 hari lalu · 19 tayangan

TRL v1.14 AsyncGRPOTrainer memungkinkan sinkronisasi hanya LoRA di Hugging Face Jobs

TRL v1.14 memperkenalkan dukungan LoRA ke AsyncGRPOTrainer, memungkinkannya melatih adapter Low-Rank Adaptation dan menyinkronkan hanya file kecil tersebut ke pekerja inferensi vLLM. Arsitektur ini memisahkan tugas pelatihan dan generasi pada mesin yang berbeda dengan menggunakan Storage Bucket bersama sebagai jembatan filesystem, menghilangkan kebutuhan akan NCCL atau komunikasi jaringan langsung antar node.

lab Hugging Face Blog · 20 hari lalu · 29 tayangan

Gradio merilis Workflow1111, membangun ulang fitur AUTOMATIC1111 sebagai grafik Gradio

Gradio telah merilis Workflow1111, sebuah proyek yang membangun kembali sebagian besar set fitur stable-diffusion-webui dari AUTOMATIC1111 menggunakan kerangka kerja gr.Workflow. Aplikasi ini terdiri dari satu kanvas yang berisi sebelas pipa media yang dibangun dari tujuh puluh tiga node, mencakup teks-ke-gambar, gambar-ke-video, dan berbagai tugas pra-pemrosesan.

lab Hugging Face Blog · 22 hari lalu · 28 tayangan

Multiverse Computing mengusulkan self-distillation yang sadar batas untuk penolakan keamanan LLM yang presisi

Sebuah makalah dari Multiverse Computing memperkenalkan metode untuk melatih model bahasa agar menolak hanya subset berbahaya tertentu dari suatu topik, alih-alih seluruh kategori, guna mengatasi keterbatasan guardrail berbasis topik yang kasar. Pendekatan ini menggunakan self-distillation yang sadar batas dengan perbaikan cakupan dan data benign dalam distribusi untuk menjaga keamanan sambil mengurangi penolakan palsu pada prompt yang sah.

lab Hugging Face Blog · 27 hari lalu · 37 tayangan

NeoMME merilis encoder multimodal efisien dengan retrieval dense dan late-interaction

Para peneliti memperkenalkan NeoMME, sebuah keluarga encoder multimodal multilingual berukuran 260M dan 800M yang memproses teks dan patch gambar mentah menggunakan satu Transformer bidirectional. Berbeda dengan model bahasa visual generatif, NeoMME tidak bergantung pada menara visi pretrained terpisah atau decoder kausal, melainkan melatih seluruh model dari awal dengan tujuan discrete-diffusion termaskir.