Moonshot AI 发布了其 Kimi K2 混合专家语言模型的模型卡和检查点。该模型在总共 1 万亿个参数中有 320 亿个激活参数,使用 Muon 优化器在 15.5T 个 token 上训练。

  • Kimi K2 专为前沿知识、推理和编码任务设计,并针对智能体能力进行了特定优化。
  • 在带有 bash/editor 工具的 SWE-bench Verified 测试中 pass@1 达到 65.8%,在 SWE-bench Multilingual 测试中达到 47.3%。
  • 该模型支持工具调用、自主问题解决以及带有名称字段的消息。
  • 检查点以 block-fp8 格式在 Hugging Face 上提供,可用于 vLLM、SGLang、KTransformers 和 TensorRT-LLM。

此次发布既提供了用于微调的基础模型,也提供了用于通用聊天和智能体体验的后训练 Kimi-K2-Instruct 变体。