Lab · Moonshot AI
arxiv arXiv cs.LG · 18 hari lalu · 3 tayangan

Moonshot AI merilis Kimi K3, model MoE 2.8T parameter dengan konteks jutaan token

Moonshot AI telah memperkenalkan Kimi K3, model Mixture-of-Experts sumber terbuka yang memiliki total 2,8 triliun parameter dan 104 miliar parameter aktif per token. Model ini mendukung kemampuan visi asli dan jendela konteks 1 juta token, memanfaatkan Kimi Delta Attention dan Stable LatentMoE untuk mencapai efisiensi penskalaan sekitar 2,5x dibandingkan pendahulunya, Kimi K2.

media Together AI Blog · 21 hari lalu · 8 tayangan

Kimi K3 menyamai Claude Fable 5 pada kualitas DeepSWE dengan biaya sepertiga

Kimi K3, model berbobot terbuka dari Moonshot AI, mencapai kinerja yang sebanding dengan Claude Fable 5 dari Anthropic pada benchmark DeepSWE sambil membutuhkan biaya jauh lebih sedikit per tugas. Dalam evaluasi tanggal 16 Juli 2026, Kimi K3 mencapai pass@1 sebesar 68,5% dibandingkan 69,9% untuk Fable 5, namun mengunggulinya dalam skenario multi-percobaan dan menawarkan efisiensi biaya yang lebih unggul.

media The Batch · 21 hari lalu LMSYS Arena (Elo) · 1760.0Elo · 3 tayangan

Kimi K3 diluncurkan sebagai model bobot terbuka terbesar; Muse Spark 1.1 dirilis

Moonshot AI memperkenalkan Kimi K3, sebuah model visi-bahasa dengan 2,8 triliun parameter yang tersedia melalui API dengan janji pelepasan bobot pada 27 Juli, memposisikannya sebagai model open-weight terbesar yang diketahui hingga saat ini. Secara bersamaan, Meta meluncurkan Muse Spark 1.1, sebuah model visi-bahasa yang dilatih untuk tugas agentic, bersama dengan akses API berbayar pertama Meta Model.

media Latent Space · 29 hari lalu · 3 tayangan

Moonshot AI meluncurkan Kimi K3, model frontier terbuka dengan 2,8T parameter

Moonshot AI telah memperkenalkan Kimi K3, model open-weights kelas frontier baru yang memiliki total 2,8 triliun parameter dan kemampuan input multimodal asli. Secara resmi diposisikan sebagai "Open Frontier Intelligence", model ini mendukung jendela konteks 1 juta token dan memanfaatkan komponen arsitektur inovatif seperti Kimi Delta Attention (KDA) dan Attention Residuals untuk meningkatkan efisiensi.