Meituan выпустила веса для LongCat-Flash-Lite-Sparse, нового варианта своей модели LongCat-Flash-Lite. Обновление внедряет LongCat Sparse Attention (LSA) для замены плотного MLA и расширяет нативную поддержку длины контекста до 1 миллиона токенов.
- Заменяет плотное Multi-Head Latent Attention на LongCat Sparse Attention (LSA).
- Нативно поддерживает длину контекста до 1M токенов по сравнению с предыдущим лимитом в 256k.
- Веса теперь доступны для загрузки на Hugging Face.