Hanyu (Olivia) Yu, una estudiante de segundo año de secundaria, está buscando un endosante de arXiv en cs.LG o cs.CV para subir su preprint independiente titulado "AttnRoute-MoE: Attention-Prior Routing for Mixture-of-Experts Vision Transformers."

El artículo introduce tres señales escalares de la matriz de autoatención — entropía, varianza entre cabezas y similitud CLS — como un prior de enrutamiento que se atenúa a cero durante el entrenamiento. La autora informa que la diversidad de enrutamiento en la inicialización previene el colapso temprano, mientras que la atención semántica moldea la especialización del experto después del entrenamiento. El trabajo incluye experimentos con 3 semillas, cuatro condiciones de ablation y un reporte honesto de un resultado no significativo p > 0.05.

arXiv requiere que los endosantes hayan presentado 3+ artículos en categorías cs.* dentro de los últimos 5 años, con al menos uno más antiguo que 3 meses.