주제 · Retrieval & RAG
lab Hugging Face Blog · 29일 전 · 조회수 8회

NVIDIA, RTEB에서 1위에 랭크된 Nemotron 3 Embed 모델 출시

NVIDIA는 생산 규모의 RAG, 에이전트 검색, 코드 검색 및 에이전트 메모리를 위한 검색 품질을 개선하도록 설계된 오픈 및 상용 임베딩 모델 컬렉션인 Nemotron 3 Embed를 출시했습니다. 이 컬렉션에는 RTEB 리더보드에서 종합 1위를 차지한 8B 모델과 배포를 위해 최적화된 효율적인 1B 변형이 포함되어 있습니다.

arxiv arXiv cs.AI · 2일 전 HealthBench · 51.9% · 조회수 4회

VITA 임상 RAG는 HealthBench에서 최첨단 LLM과 동등하거나 이를 능가

저소득 및 중산층 국가를 위해 설계된 목적 특화 검색 증강 생성 시스템인 VITA가 HealthBench 벤치마크에서 범용 대규모 언어 모델들과 비교 평가되었습니다. 이 연구는 새로운 최첨단 모델이 출시됨에 따라라도 코퍼스 특화 설계가 경쟁력 있는 성능을 유지할 수 있음을 보여줍니다.

arxiv arXiv cs.LG · 2일 전 HealthBench · 51.9% · 조회수 5회

VITA 임상 RAG 시스템이 HealthBench에서 최전방 LLM과 동등하거나 우수함

저소득 및 중소득 환경을 위해 설계된 전용 검색 증강 생성(RAG) 시스템인 VITA가 HealthBench 벤치마크에서 범용 대규모 언어 모델에 대해 평가되었습니다. GPT-4.1 심판이 채점한 4,023개의 질문에 대해 VITA는 가능한 루브릭 포인트의 51.9%를 획득하여 1위를 차지했으며, GPT-5.4, o4-mini, Gemini 3.1 Pro 및 Claude Sonnet 4.6을 앞질렀습니다.

media Hugging Face Forums · 12일 전 · 조회수 7회

IntelShed는 하이브리드 RAG, GNN 엔티티 해결, 연성 학습 및 LLM 다중 에이전트 오케스트레이션을 결합합니다

저자는 오픈소스 인텔리전스(OSINT)를 위한 오픈소스 시스템인 IntelShed를 소개하며, 이는 50개의 공개 데이터 피드를 집계하여 자동화된 24시간 보안 브리핑을 생성합니다. 아키텍처는 하이브리드 검색, GNN 기반 엔티티 해결, 차분 프라이버시가 적용된 연성 학습, 그리고 LLM 컴파일된 다중 에이전트 오케스트레이션을 통합합니다.

media Hugging Face Forums · 16일 전 · 조회수 3회

TIS 2.0이 토큰 중요도 점수를 사용하여 문서 순서를 재배치함으로써 RAG의 위치 편향을 제거합니다

TIS 2.0 업데이트는 추가 학습 없이 검색 증강 생성(RAG)에서 "중간 유실" 위치 편향을 제거하는 문서 재배치 기능을 도입합니다. 학습된 토큰 중요도 점수를 적용하여 검색된 문서를 재배치함으로써 시스템은 위치 간극을 0으로 만들고 베이스라인 대비 정확 일치(Exact Match) 정확도를 5%p 향상시킵니다.

media Hugging Face Forums · 18일 전 · 조회수 2회

DESi 리뷰: 구조화된 인식론적 논문 검토를 위한 설치 가능한 Claude 스킬

저자는 모델 독립적인 DESi 인식론적 거버넌스 프레임워크의 실용적인 적용 사례로, 설치 가능한 Claude 스킬로 패키징된 DESi Review를 출시했습니다. 이 도구는 결정론적 주장 추출과 모델 기반 심판을 분리하여 영어 텍스트에 대해 구조화된 논문 검토 파이프라인을 실행합니다.

media Hugging Face Forums · 22일 전

희소 오토인코더를 사용한 ELIZA

새로운 ELIZA 챗봇 구현은 희소 오토인코더 아키텍처를 활용하여 대화 기록을 잠재적 메모리 레이어에 저장하며, 전통적인 키워드 매칭 방식의 한계를 극복하는 것을 목표로 합니다. 이 시스템은 32,768개의 뉴런으로 구성된 메모리 레이어를 갖춘 T5 인코더-디코더 구조를 사용하며, 대조 학습을 통해 유사한 기록이 활성화됩니다.

media r/LocalLLaMA · 23일 전 · 조회수 6회

PaddlePaddle가 계층적 병렬 디코딩을 갖춘 1B 모델 HPD-Parsing 출시

PaddlePaddle는 처리량 향상을 위해 계층적 병렬 디코딩 패러다임을 활용하는 경량 10억 파라미터 문서 파싱 모델인 HPD-Parsing을 소개했습니다. 이 아키텍처는 메인 레이아웃 브랜치를 통해 전역 페이지 구조를 조정하고, 동시 브랜치에 로컬화된 콘텐츠 생성을 분배하며, Progressive Multi-Token Prediction을 활용하여 디코딩 단계를 줄입니다.

media Hugging Face Forums · 23일 전 · 조회수 1회

저자는 로컬 LLM의 증거 포화 상태를 위한 공개 k 레지스트리를 제안합니다

저자는 언어 모델의 증거 포화 지점(k*)을 측정하기 위해 Hugging Face에서 파일럿 논문과 공개 레지스트리를 게시했습니다. 이 지표는 프롬프트에 주입할 최적의 증거 조각 수를 결정하며, 더 많은 컨텍스트를 추가해도 정확도가 단조롭게 향상되지 않으며 비용이나 인식론적 오염이 증가할 수 있기 때문입니다.

media Hugging Face Forums · 27일 전 · 조회수 3회

계층적 에이전트 메모리는 구조화된 검색을 위해 쌍곡형 임베딩 사용

새로운 메모리 아키텍처는 "추상화 점수"에 따라 벡터 데이터베이스 항목을 조직하기 위해 쌍곡형 임베딩을 사용하여, 에이전트가 평면 RAG 시스템보다 더 효과적으로 지식을 관리할 수 있도록 합니다. 이 접근 방식은 추상적인 항목(예: 선호도)이 중심에 있고 구체적인 사건이 경계에 위치하도록 데이터를 구조화하여, 더 나은 클러스터링과 검색을 용이하게 합니다.

media Hugging Face Forums · 29일 전

ShinBay-UCTF, 프라이버시를 보호하는 지속적 학습과 압축 지식을 위한 개념적 프레임워크 제안

K7007은 다국어 중복성, 지속적인 에피소드 기억, 그리고 지속적 적응에 관한 AI 시스템의 한계를 해결하는 개념적 프레임워크인 ShinBay-UCTF를 제시합니다. 이 제안서는 세 가지 상호작용하는 레이어로 구성된 통합 아키텍처를 개요로 제시합니다: 보편적 압축 학습 형식(UCTF), 생물학적 영감을 받은 에피소드 기억, 그리고 환경 기반 지속적 학습.