Para peneliti memperkenalkan Kimi K2, sebuah model bahasa besar Mixture-of-Experts yang memiliki 32 miliar parameter aktif dari total satu triliun. Model ini memanfaatkan pengoptimal MuonClip yang baru untuk mengatasi ketidakstabilan pelatihan sambil mempertahankan efisiensi token selama pra-pelatihan pada 15,5 triliun token.
- Kimi K2 mencapai kinerja terbaik di antara model non-berpikir sumber terbuka, dengan skor 66,1 pada Tau2-Bench dan 76,5 pada ACEBench (En).
- Model ini mencapai 65,8 pada SWE-Bench Verified dan 47,3 pada SWE-Bench Multilingual, melampaui sebagian besar baseline sumber terbuka dan tertutup dalam pengaturan non-berpikir.
- Model ini menunjukkan kemampuan kuat dalam pemrograman dan penalaran dengan skor 53,7 pada LiveCodeBench v6, 49,5 pada AIME 2025, dan 75,1 pada GPQA-Diamond.
- Pasca-pelatihan melibatkan proses multi-tahap termasuk sintesis data agentic skala besar dan pembelajaran penguatan bersama untuk meningkatkan kemampuan agentic.
Rilis checkpoint model dasar dan pasca-pelatihan bertujuan untuk memfasilitasi penelitian dan aplikasi kecerdasan agentic di masa depan.