Moonshot AI ha publicado la tarjeta del modelo y los puntos de control para su modelo de lenguaje Kimi K2 de mezcla de expertos. El modelo cuenta con 32 mil millones de parámetros activados de un total de 1 billón, entrenado en 15,5T tokens utilizando el optimizador Muon.
- Kimi K2 está diseñado para tareas de conocimiento de vanguardia, razonamiento y codificación con una optimización específica para capacidades agénticas.
- Alcanza un 65,8% pass@1 en las pruebas SWE-bench Verified con herramientas bash/editor y un 47,3% en las pruebas SWE-bench Multilingual.
- El modelo soporta llamada de herramientas, resolución autónoma de problemas y mensajes con campos de nombre.
- Los puntos de control están disponibles en formato block-fp8 en Hugging Face para usar con vLLM, SGLang, KTransformers y TensorRT-LLM.
El lanzamiento proporciona tanto un modelo base para ajuste fino como la variante Kimi-K2-Instruct post-entrenada para chat de propósito general y experiencias agénticas.