Retrieval & RAG
media Hugging Face Forums · hace 6 d · 3 vistas

IntelShed combina RAG híbrido, resolución de entidades GNN, aprendizaje federado y orquestación multiagente con LLM

El autor presenta IntelShed, un sistema de código abierto para inteligencia de código abierto (OSINT) que agrega 50 fuentes de datos públicas para producir informes de seguridad automatizados de 24 horas. La arquitectura integra recuperación híbrida, resolución de entidades basada en GNN, aprendizaje federado con privacidad diferencial y orquestación multiagente compilada por LLM.

media Hugging Face Forums · hace 10 d · 1 vista

TIS 2.0 elimina el sesgo de posición en RAG reordenando pasajes con puntuaciones de importancia de tokens

La actualización TIS 2.0 introduce una capacidad de reordenamiento de pasajes que elimina el sesgo de posición "perdido-en-el-medio" en la generación aumentada por recuperación sin requerir entrenamiento adicional. Al aplicar puntuaciones aprendidas de importancia de tokens para reordenar los documentos recuperados, el sistema logra una brecha de posición cero y mejora la precisión de coincidencia exacta en 5 puntos porcentuales sobre las líneas base.

media Hugging Face Forums · hace 12 d · 1 vista

Los gráficos de memoria ponderados por atención utilizan la atención de Jina para el recorrido de graph-RAG

Una nueva propuesta describe una estructura de memoria LLM que combina el fragmentado tardío con aristas ponderadas por atención para permitir un recorrido paso a paso. El sistema aprovecha el modelo de incrustación de Jina AI, que calcula la atención entre oraciones, para derivar los pesos de las aristas del procesamiento interno del documento.

media Hugging Face Forums · hace 13 d · 2 vistas

Reseña de DESi Review: una habilidad instalable de Claude para la revisión estructurada de artículos epistémicos

El autor ha lanzado DESi Review, una aplicación práctica del marco de gobernanza epistémica DESi independiente del modelo, empaquetada como una habilidad instalable de Claude. Esta herramienta ejecuta un pipeline estructurado de revisión de artículos sobre texto en inglés separando la extracción determinista de afirmaciones de la adjudicación basada en modelos.

media Hugging Face Forums · hace 17 d

ELIZA con autoencoder disperso

Una nueva implementación del chatbot ELIZA utiliza una arquitectura de autoencoder disperso para almacenar entradas de conversación en una capa de memoria latente, con el objetivo de mejorar los métodos tradicionales de coincidencia de palabras clave. El sistema emplea una estructura codificador-decodificador T5 con una capa de memoria de 32,768 neuronas, donde las entradas similares se activan mediante aprendizaje contrastivo.

media r/LocalLLaMA · hace 17 d · 3 vistas

PaddlePaddle lanza HPD-Parsing, un modelo de 1B con decodificación paralela jerárquica

PaddlePaddle ha presentado HPD-Parsing, un modelo ligero de parsing de documentos con 1.000 millones de parámetros que utiliza un paradigma de Decodificación Paralela Jerárquica para mejorar el rendimiento. La arquitectura coordina la estructura global de la página a través de una rama principal de diseño, mientras distribuye la generación de contenido localizado a ramas concurrentes, utilizando Predicción Progresiva de Múltiples Tokens para reducir los pasos de decodificación.

media Hugging Face Forums · hace 18 d · 1 vista

El autor propone un registro abierto de k para la saturación de evidencia en LLM locales

El autor ha publicado un artículo piloto y un registro abierto en Hugging Face para medir el punto de saturación de evidencia (k*) de los modelos de lenguaje. Esta métrica determina el número óptimo de fragmentos de evidencia para inyectar en los prompts, ya que agregar más contexto no mejora monótonamente la corrección y puede aumentar el costo o la contaminación epistémica.

media Hugging Face Forums · hace 22 d · 3 vistas

La memoria agente jerárquica utiliza incrustaciones hiperbólicas para la recuperación estructurada

Una nueva arquitectura de memoria emplea incrustaciones hiperbólicas para organizar las entradas de la base de datos vectorial mediante una "puntuación de abstracción", permitiendo que los agentes gestionen el conocimiento con mayor eficacia que los sistemas RAG planos. Este enfoque estructura los datos de modo que las entradas abstractas, como las preferencias, se sitúan cerca del centro mientras que los eventos concretos residen en el límite, facilitando un mejor agrupamiento y recuperación.

media Hugging Face Forums · hace 23 d

ShinBay-UCTF propone un marco conceptual para el aprendizaje continuo con preservación de la privacidad y conocimiento comprimido

K7007 presenta ShinBay-UCTF, un marco conceptual que aborda limitaciones en los sistemas de IA respecto a la redundancia multilingüe, la memoria episódica persistente y la adaptación continua. La propuesta describe una arquitectura unificada compuesta por tres capas interactuantes: Universal Compressed Training Format (UCTF), Memoria Episódica Inspirada Biológicamente y Aprendizaje Continuo Impulsado por el Entorno.

arxiv arXiv cs.AI · hace 23 d · 1 vista

RAGU presenta un motor GraphRAG de múltiples pasos con el extractor compacto Meno-Lite-0.1

RAGU es un motor GraphRAG modular de código abierto que mejora la integración del conocimiento estructurado separando la extracción de entidades de su consolidación. Utiliza un proceso de extracción tipificado en dos etapas, deduplicación respaldada por DBSCAN, resumen con LLM y detección de comunidades Leiden para reducir el ruido y la fragilidad presentes en los sistemas de paso único.

lab Hugging Face Blog · hace 24 d · 8 vistas

NVIDIA lanza los modelos de incrustación Nemotron 3 Embed que ocupan el #1 en RTEB

NVIDIA ha lanzado Nemotron 3 Embed, una colección de modelos de incrustación abiertos y comercialmente disponibles diseñados para mejorar la calidad de recuperación para RAG a escala de producción, recuperación agéntica, recuperación de código y memoria de agentes. La colección incluye un modelo de 8B que ocupa el #1 en general en el ranking de RTEB, junto con variantes eficientes de 1B optimizadas para su implementación.

arxiv arXiv cs.CL · hace 24 d

RAGthoven utiliza un pipeline RAG de múltiples etapas para empatar con Gemini 2.5 Flash en generación de humor multilingüe

Los autores presentan RAGthoven, un sistema para SemEval-2026 Task 1 que descompone la generación creativa de texto en un pipeline de modelos de lenguaje grandes de múltiples etapas basado en la teoría computacional del humor. La configuración final augmenta el Planner con generación aumentada por recuperación (RAG) a partir de un corpus de chistes curado y evalúa variantes agénticas frente a una línea base no agéntica.

arxiv arXiv cs.CL · hace 24 d · 1 vista

Marco híbrido Apaf analiza el discurso en políticas de gobernanza de desastres

Los autores presentan Apaf, una tubería híbrida LLM-simbólica que operacionaliza el análisis crítico del discurso como un marco de argumentación bipolar cuantitativo sobre texto de política. Los argumentos se clasifican en marcos deliberativos o gerenciales, y cuatro subtipos de relación mediada por marco se producen mediante reglas deterministas sobre características extraídas por LLM.

arxiv arXiv cs.CL · hace 24 d

Las señales de LLM-as-a-judge no optimizan el reconocimiento de tablas en bucle cerrado

Un estudio que utiliza FinTabNet y OmniDocBench demuestra que las señales de LLM-as-a-judge son insuficientes para optimizar la regeneración en bucle cerrado en el reconocimiento de tablas. La investigación revela que las puntuaciones de los jueces frecuentemente empataron, los rangos no fueron reproducibles y el sistema falló al recuperar mejores candidatos producidos por la iteración.

arxiv arXiv cs.CL · hace 24 d

La capa POS reduce a la mitad los datos necesarios para la glosado interlineado automatizado del Ryukyuan de Irabu

Los investigadores implementaron una canalización de anotación neuronal para el Ryukyuan de Irabu con el fin de automatizar la creación de textos interlineados, abordando el alto costo de la documentación manual. El estudio evaluó la segmentación de morfemas, la etiquetación POS y el glosado utilizando pequeños modelos BiLSTM-CRF bajo una restricción estricta de aproximadamente una hora de discurso anotado.