Meituan telah merilis bobot untuk LongCat-Flash-Lite-Sparse, varian baru dari model LongCat-Flash-Lite-nya. Pembaruan ini memperkenalkan LongCat Sparse Attention (LSA) untuk menggantikan MLA padat dan memperluas dukungan panjang konteks asli hingga 1 juta token.

  • Mengganti Multi-Head Latent Attention padat dengan LongCat Sparse Attention (LSA).
  • Mendukung panjang konteks hingga 1M token secara native, dibandingkan batas sebelumnya sebesar 256k.
  • Bobot kini tersedia untuk diunduh di Hugging Face.