Meituan a publié les poids pour LongCat-Flash-Lite-Sparse, une nouvelle variante de son modèle LongCat-Flash-Lite. La mise à jour introduit LongCat Sparse Attention (LSA) pour remplacer le MLA dense et étend la prise en charge native de la longueur du contexte à 1 million de tokens.

  • Remplace l'attention Multi-Head Latent dense par LongCat Sparse Attention (LSA).
  • Prend nativement en charge des longueurs de contexte allant jusqu'à 1M tokens, contre une limite précédente de 256k.
  • Les poids sont désormais disponibles au téléchargement sur Hugging Face.