Una evaluación de 600 casos en el conjunto de datos MuSiQue utilizando los modelos congelados Qwen2.5-7B-Instruct y MiniLM prueba si la selección de contexto consciente de puentes puede superar al contexto completo y otras líneas base.
- La promoción de puente semántico logró una F1 de 0.3482, superando a BM25 (0.3113) y al núcleo semántico con promoción aleatoria (0.3310).
- El enfoque utilizó un 16.6% menos de tokens de entrada que el contexto completo mientras reducía el tiempo de prellenado en un 15.3% y la latencia en un 9.6%.
- Las comparaciones de bootstrap emparejadas muestran ganancias estadísticamente significativas en F1 sobre BM25 (+0.0368) y controles aleatorios (+0.0172).
- La diferencia entre la promoción de puente y el contexto completo no fue concluyente, con un delta de F1 de +0.0101.
Los resultados sugieren que la promoción consciente de puentes preserva más confiablemente la evidencia dependiente de las relaciones que el acortamiento genérico o la selección léxica.