A Moonshot AI lançou o cartão do modelo e os checkpoints para seu modelo de linguagem Kimi K2 mixture-of-experts. O modelo possui 32 bilhões de parâmetros ativados de um total de 1 trilhão, treinado em 15,5T tokens usando o otimizador Muon.
- Kimi K2 é projetado para tarefas de conhecimento de fronteira, raciocínio e codificação com otimização específica para capacidades agênticas.
- Alcança 65,8% pass@1 nos testes SWE-bench Verified com ferramentas bash/editor e 47,3% nos testes SWE-bench Multilingual.
- O modelo suporta chamada de ferramentas, resolução autônoma de problemas e mensagens com campos de nome.
- Os checkpoints estão disponíveis no formato block-fp8 no Hugging Face para uso com vLLM, SGLang, KTransformers e TensorRT-LLM.
O lançamento fornece tanto um modelo base para ajuste fino quanto a variante Kimi-K2-Instruct pós-treinada para chat de propósito geral e experiências agênticas.