Moonshot AI telah merilis kartu model dan checkpoint untuk model bahasa mixture-of-experts Kimi K2-nya. Model ini memiliki 32 miliar parameter yang diaktifkan dari total 1 triliun, dilatih pada 15,5T token menggunakan optimizer Muon.
- Kimi K2 dirancang untuk tugas pengetahuan terdepan, penalaran, dan pemrograman dengan optimasi khusus untuk kemampuan agentic.
- Mencapai 65,8% pass@1 pada tes SWE-bench Verified dengan alat bash/editor dan 47,3% pada tes SWE-bench Multilingual.
- Model ini mendukung pemanggilan alat, penyelesaian masalah otonom, dan pesan dengan bidang nama.
- Tersedia dalam format block-fp8 di Hugging Face untuk digunakan dengan vLLM, SGLang, KTransformers, dan TensorRT-LLM.
Rilis ini menyediakan model dasar untuk fine-tuning serta varian Kimi-K2-Instruct pasca-pelatihan untuk obrolan tujuan umum dan pengalaman agentic.