Kimi K3 ने AfterQuery के SpreadsheetBench 2 मूल्यांकन में शीर्ष स्थान प्राप्त किया है। इस परिणाम ने इसे इस विशिष्ट बेंचमार्क में Claude Fable 5 से आगे रख दिया है।
AfterQuery के SpreadsheetBench 2 पर Kimi K3 ने #1 स्थान हासिल किया, Claude Fable 5 को पार कर गया
Kimi K3 एजेंट एरिना पर ओपस के सोचने के स्तर के बराबर रैंक करता है
एजेंट एरिना लीडरबोर्ड के अनुसार, किमी K3 गैर-दृश्य कार्यों में ओपस के समान स्तर पर प्रदर्शन करता है। हालांकि कुछ उपयोगकर्ताओं ने नोट किया है कि ओपस को दृश्य क्षमताओं में फायदा हो सकता है, रैंकिंग अन्य उपयोग मामलों के लिए समानता को दर्शाती है।
Kimi K3 (max) ने Simple Bench पर Sonnet 5 को हराया
लेख में बताया गया है कि Kimi K3 (max), Simple Bench बेंचमार्क पर Sonnet 5 से बेहतर प्रदर्शन करता है।
Kimi K3 के रिलीज़ के बाद Moonshot AI ने हांगकांग में IPO की योजना बनाई
Kimi K3 मॉडल के रिलीज़ होने के बाद, Moonshot AI ने निवेशकों को सूचित किया है कि वह अगले छह महीनों के भीतर हांगकांग में एक प्रारंभिक सार्वजनिक पेशकश (IPO) की योजना बना रहा है।
Moonshot AI ने Kimi K3 जारी किया, एक 2.8T पैरामीटर MoE मॉडल
16 जुलाई को, Moonshot AI ने अपना नवीनतम फ्लैगशिप मॉडल, Kimi K3, जारी किया, जो 2.8 ट्रिलियन पैरामीटर वाले Mixture of Experts (MoE) आर्किटेक्चर है। कंपनी ने 27 जुलाई को मॉडल के वजन जारी करने का वादा किया है।
बेंचमार्क, लाइसेंस और सर्विंग लागत पर Kimi K3, DeepSeek V4 Pro और GLM-5.2 की तुलना
तीन ओपन-वेट स्पर्स मिक्स्चर-ऑफ-एक्सपर्ट्स मॉडल्स—Moonshot AI का Kimi K3, DeepSeek V4 Pro, और Zhipu AI का GLM-5.2—की तुलना लंबे समय तक चलने वाले कोडिंग और एजेंट वर्कलोड के लिए उनकी क्षमताओं, लाइसेंस शर्तों और सर्विंग लागत के आधार पर की गई है।