Meituan ha publicado los pesos para LongCat-Flash-Lite-Sparse, una nueva variante de su modelo LongCat-Flash-Lite. La actualización introduce LongCat Sparse Attention (LSA) para reemplazar el MLA denso y extiende el soporte nativo de longitud de contexto a 1 millón de tokens.
- Reemplaza la Multi-Head Latent Attention densa con LongCat Sparse Attention (LSA).
- Admite nativamente longitudes de contexto de hasta 1M tokens, en comparación con el límite anterior de 256k.
- Los pesos ya están disponibles para descargar en Hugging Face.