Retrieval & RAG
media Hugging Face Forums · 6 hari lalu · 3 tayangan

IntelShed menggabungkan RAG hibrida, resolusi entitas GNN, pembelajaran terdesentralisasi, dan orkestrasi agen-multi LLM

Penulis menyajikan IntelShed, sebuah sistem sumber terbuka untuk intelijen sumber terbuka (OSINT) yang mengagregasi 50 umpan data publik untuk menghasilkan ringkasan keamanan otomatis selama 24 jam. Arsitektur ini mengintegrasikan pengambilan hibrida, resolusi entitas berbasis GNN, pembelajaran terdesentralisasi dengan privasi diferensial, dan orkestrasi agen-multi yang dikompilasi oleh LLM.

media Hugging Face Forums · 10 hari lalu · 1 tayangan

TIS 2.0 menghilangkan bias posisi dalam RAG dengan menyusun ulang dokumen menggunakan skor kepentingan token

Pembaruan TIS 2.0 memperkenalkan kemampuan penyusunan ulang dokumen yang menghilangkan bias posisi "lost-in-the-middle" dalam generasi yang diperkaya pengambilan tanpa memerlukan pelatihan tambahan. Dengan menerapkan skor kepentingan token yang telah dipelajari untuk menyusun ulang dokumen yang diambil, sistem mencapai kesenjangan posisi nol dan meningkatkan akurasi kecocokan tepat sebesar 5 poin persentase dibandingkan dengan baseline.

media Hugging Face Forums · 13 hari lalu · 2 tayangan

Ulasan DESi Review: keterampilan Claude yang dapat diinstal untuk ulasan paper epistemik terstruktur

Penulis telah merilis DESi Review, sebuah aplikasi praktis dari kerangka kerja tata kelola epistemik DESi yang independen terhadap model, dikemas sebagai keterampilan Claude yang dapat diinstal. Alat ini menjalankan alur kerja ulasan paper terstruktur atas teks bahasa Inggris dengan memisahkan ekstraksi klaim deterministik dari adjudikasi berbasis model.

media r/LocalLLaMA · 17 hari lalu · 3 tayangan

PaddlePaddle merilis HPD-Parsing, model 1B dengan dekoding paralel hierarkis

PaddlePaddle telah memperkenalkan HPD-Parsing, model parsing dokumen ringan dengan 1 miliar parameter yang memanfaatkan paradigma Hierarchical Parallel Decoding untuk meningkatkan throughput. Arsitektur ini mengoordinasikan struktur halaman global melalui cabang tata letak utama sambil mendistribusikan generasi konten terlokalisasi ke cabang-cabang konkuren, dengan memanfaatkan Progressive Multi-Token Prediction untuk mengurangi langkah dekoding.

media Hugging Face Forums · 22 hari lalu · 3 tayangan

Memori Agens Hierarkis Menggunakan Embedding Hiperbolik untuk Retrieval Terstruktur

Arsitektur memori baru menggunakan embedding hiperbolik untuk mengatur entri basis data vektor berdasarkan "skor abstraksi," memungkinkan agen mengelola pengetahuan lebih efektif daripada sistem RAG datar. Pendekatan ini menyusun data sehingga entri abstrak, seperti preferensi, berada di dekat pusat sementara peristiwa konkret berada di batas, memfasilitasi pengelompokan dan retrieval yang lebih baik.

media Hugging Face Forums · 23 hari lalu

ShinBay-UCTF mengusulkan kerangka konseptual untuk pembelajaran berkelanjutan yang menjaga privasi dan pengetahuan terkompresi

K7007 menyajikan ShinBay-UCTF, sebuah kerangka konseptual yang mengatasi keterbatasan dalam sistem AI terkait redundansi multibahasa, memori episodik persisten, dan adaptasi berkelanjutan. Proposal ini menguraikan arsitektur terpadu yang terdiri dari tiga lapisan yang saling berinteraksi: Universal Compressed Training Format (UCTF), Memori Episodik Terinspirasi Biologis, dan Pembelajaran Berkelanjutan yang Didorong Lingkungan.

arxiv arXiv cs.AI · 23 hari lalu · 1 tayangan

RAGU memperkenalkan mesin GraphRAG multi-langkah dengan ekstraktor Meno-Lite-0.1 yang ringkas

RAGU adalah mesin GraphRAG modular sumber terbuka yang meningkatkan integrasi pengetahuan terstruktur dengan memisahkan ekstraksi entitas dari konsolidasi. Mesin ini memanfaatkan proses ekstraksi bertipe dua tahap, deduplikasi berbasis DBSCAN, peringkasan LLM, dan deteksi komunitas Leiden untuk mengurangi kebisingan dan kerapuhan yang ditemukan pada sistem satu kali lewati.

lab Hugging Face Blog · 24 hari lalu · 8 tayangan

NVIDIA merilis model Embed Nemotron 3 yang menduduki peringkat #1 di RTEB

NVIDIA telah merilis Nemotron 3 Embed, sebuah koleksi model embedding terbuka dan tersedia secara komersial yang dirancang untuk meningkatkan kualitas retrieval untuk RAG skala produksi, retrieval agentic, retrieval kode, dan memori agen. Koleksi ini menampilkan model 8B yang menduduki peringkat #1 secara keseluruhan di papan peringkat RTEB, bersama dengan varian 1B yang dioptimalkan untuk deployment.

arxiv arXiv cs.CL · 24 hari lalu

RAGthoven menggunakan pipeline RAG multi-tahap untuk menyamai Gemini 2.5 Flash dalam generasi humor multibahasa

Para penulis menyajikan RAGthoven, sebuah sistem untuk SemEval-2026 Task 1 yang menguraikan generasi teks kreatif ke dalam pipeline model bahasa besar multi-tahap yang berlandaskan teori humor komputasi. Konfigurasi akhir meningkatkan Perencana dengan generasi yang diperkaya pengambilan dari korpus lelucon kurasi dan mengevaluasi varian agentic terhadap baseline non-agentic.

arxiv arXiv cs.CL · 24 hari lalu · 1 tayangan

Kerangka kerja hibrida Apaf menganalisis wacana dalam kebijakan tata kelola bencana

Para penulis menyajikan Apaf, sebuah pipa LLM-simbolik hibrida yang mengoperasionalkan analisis wacana kritis sebagai kerangka argumentasi bipolar kuantitatif atas teks kebijakan. Argumen diklasifikasikan ke dalam bingkai deliberatif atau manajerial, dan empat subtipe hubungan yang dimediasi bingkai dihasilkan oleh aturan deterministik pada fitur yang diekstrak oleh LLM.