Topik · Retrieval & RAG
lab Hugging Face Blog · 29 hari lalu · 8 tayangan

NVIDIA merilis model Embed Nemotron 3 yang menduduki peringkat #1 di RTEB

NVIDIA telah merilis Nemotron 3 Embed, sebuah koleksi model embedding terbuka dan tersedia secara komersial yang dirancang untuk meningkatkan kualitas retrieval untuk RAG skala produksi, retrieval agentic, retrieval kode, dan memori agen. Koleksi ini menampilkan model 8B yang menduduki peringkat #1 secara keseluruhan di papan peringkat RTEB, bersama dengan varian 1B yang dioptimalkan untuk deployment.

arxiv arXiv cs.AI · 2 hari lalu HealthBench · 51.9% · 4 tayangan

RAG klinis VITA menyamai atau mengungguli LLM terdepan pada HealthBench

Sebuah sistem retrieval-augmented generation yang dirancang khusus bernama VITA, yang ditujukan untuk negara berpenghasilan rendah dan menengah, dievaluasi terhadap model bahasa besar umum pada benchmark HealthBench. Studi ini menunjukkan bahwa desain yang spesifik terhadap korpus dapat mempertahankan kinerja kompetitif meskipun model terdepan baru terus dirilis.

arxiv arXiv cs.LG · 2 hari lalu HealthBench · 51.9% · 5 tayangan

Sistem RAG klinis VITA menyamai atau mengungguli LLM terdepan di HealthBench

Sebuah sistem generasi yang diperkaya dengan pengambilan kembali (RAG) yang dirancang khusus bernama VITA, yang ditujukan untuk pengaturan pendapatan rendah dan menengah, dievaluasi terhadap model bahasa besar tujuan umum pada benchmark HealthBench. Pada 4.023 pertanyaan yang dinilai oleh hakim GPT-4.1, VITA berada di peringkat pertama dengan 51,9% dari poin rubrik yang mungkin, melampaui GPT-5.4, o4-mini, Gemini 3.1 Pro, dan Claude Sonnet 4.6.

media Hugging Face Forums · 12 hari lalu · 7 tayangan

IntelShed menggabungkan RAG hibrida, resolusi entitas GNN, pembelajaran terdesentralisasi, dan orkestrasi agen-multi LLM

Penulis menyajikan IntelShed, sebuah sistem sumber terbuka untuk intelijen sumber terbuka (OSINT) yang mengagregasi 50 umpan data publik untuk menghasilkan ringkasan keamanan otomatis selama 24 jam. Arsitektur ini mengintegrasikan pengambilan hibrida, resolusi entitas berbasis GNN, pembelajaran terdesentralisasi dengan privasi diferensial, dan orkestrasi agen-multi yang dikompilasi oleh LLM.

media Hugging Face Forums · 16 hari lalu · 3 tayangan

TIS 2.0 menghilangkan bias posisi dalam RAG dengan menyusun ulang dokumen menggunakan skor kepentingan token

Pembaruan TIS 2.0 memperkenalkan kemampuan penyusunan ulang dokumen yang menghilangkan bias posisi "lost-in-the-middle" dalam generasi yang diperkaya pengambilan tanpa memerlukan pelatihan tambahan. Dengan menerapkan skor kepentingan token yang telah dipelajari untuk menyusun ulang dokumen yang diambil, sistem mencapai kesenjangan posisi nol dan meningkatkan akurasi kecocokan tepat sebesar 5 poin persentase dibandingkan dengan baseline.

media Hugging Face Forums · 18 hari lalu · 2 tayangan

Ulasan DESi Review: keterampilan Claude yang dapat diinstal untuk ulasan paper epistemik terstruktur

Penulis telah merilis DESi Review, sebuah aplikasi praktis dari kerangka kerja tata kelola epistemik DESi yang independen terhadap model, dikemas sebagai keterampilan Claude yang dapat diinstal. Alat ini menjalankan alur kerja ulasan paper terstruktur atas teks bahasa Inggris dengan memisahkan ekstraksi klaim deterministik dari adjudikasi berbasis model.

media r/LocalLLaMA · 23 hari lalu · 6 tayangan

PaddlePaddle merilis HPD-Parsing, model 1B dengan dekoding paralel hierarkis

PaddlePaddle telah memperkenalkan HPD-Parsing, model parsing dokumen ringan dengan 1 miliar parameter yang memanfaatkan paradigma Hierarchical Parallel Decoding untuk meningkatkan throughput. Arsitektur ini mengoordinasikan struktur halaman global melalui cabang tata letak utama sambil mendistribusikan generasi konten terlokalisasi ke cabang-cabang konkuren, dengan memanfaatkan Progressive Multi-Token Prediction untuk mengurangi langkah dekoding.

media Hugging Face Forums · 28 hari lalu · 3 tayangan

Memori Agens Hierarkis Menggunakan Embedding Hiperbolik untuk Retrieval Terstruktur

Arsitektur memori baru menggunakan embedding hiperbolik untuk mengatur entri basis data vektor berdasarkan "skor abstraksi," memungkinkan agen mengelola pengetahuan lebih efektif daripada sistem RAG datar. Pendekatan ini menyusun data sehingga entri abstrak, seperti preferensi, berada di dekat pusat sementara peristiwa konkret berada di batas, memfasilitasi pengelompokan dan retrieval yang lebih baik.

media Hugging Face Forums · 29 hari lalu

ShinBay-UCTF mengusulkan kerangka konseptual untuk pembelajaran berkelanjutan yang menjaga privasi dan pengetahuan terkompresi

K7007 menyajikan ShinBay-UCTF, sebuah kerangka konseptual yang mengatasi keterbatasan dalam sistem AI terkait redundansi multibahasa, memori episodik persisten, dan adaptasi berkelanjutan. Proposal ini menguraikan arsitektur terpadu yang terdiri dari tiga lapisan yang saling berinteraksi: Universal Compressed Training Format (UCTF), Memori Episodik Terinspirasi Biologis, dan Pembelajaran Berkelanjutan yang Didorong Lingkungan.