Kimi K3 telah mencapai posisi utama dalam evaluasi SpreadsheetBench 2 dari AfterQuery. Hasil ini menempatkannya di depan Claude Fable 5 dalam benchmark spesifik ini.
Kimi K3 menduduki peringkat #1 di SpreadsheetBench 2 AfterQuery, melampaui Claude Fable 5
Kimi K3 peringkat sama dengan Opus berpikir di Agent Arena
Menurut papan peringkat Agent Arena, Kimi K3 berkinerja setara dengan Opus dalam tugas non-visi. Meskipun beberapa pengguna mencatat bahwa Opus mungkin memiliki keunggulan dalam kemampuan visi, peringkat menunjukkan kesetaraan untuk kasus penggunaan lainnya.
Kimi K3 (max) mengalahkan Sonnet 5 di Simple Bench
Artikel tersebut melaporkan bahwa Kimi K3 (max) mengungguli Sonnet 5 pada benchmark Simple Bench.
Moonshot AI merencanakan IPO di Hong Kong setelah peluncuran Kimi K3
Setelah peluncuran model Kimi K3, Moonshot AI telah memberi tahu investor bahwa mereka berencana melakukan penawaran umum perdana (IPO) di Hong Kong dalam enam bulan ke depan.
Moonshot AI merilis Kimi K3, model MoE dengan 2,8 triliun parameter
Pada 16 Juli, Moonshot AI merilis model andalan terbarunya, Kimi K3, sebuah arsitektur Mixture of Experts (MoE) dengan 2,8 triliun parameter. Perusahaan telah berjanji untuk merilis bobot model pada 27 Juli.
Kimi K3, DeepSeek V4 Pro, dan GLM-5.2 dibandingkan pada benchmark, lisensi, dan biaya penyajian
Sebuah perbandingan tiga model Sparse Mixture-of-Experts berbobot terbuka—Kimi K3 dari Moonshot AI, DeepSeek V4 Pro, dan GLM-5.2 dari Zhipu AI—mengevaluasi kemampuan, ketentuan lisensi, dan biaya penyajian mereka untuk beban kerja pemrograman jangka panjang dan agen.