قام مستخدم بتقييم Kimi K3 مقابل Claude Opus 4.8 من خلال تشغيل 34 طلبًا للنمذجة الواحدة وتقييم HTML ولقطات الشاشة وملفات GIF الناتجة باستخدام Sonnet 4.6. خلص التقييم إلى أن Kimi K3 أنتج نتائج أفضل من Opus 4.8.

  • تم اختبار Kimi K3 على 34 طلبًا للنمذجة الواحدة مع تقييم المخرجات بواسطة Sonnet 4.6.
  • أظهر النموذج أداءً متفوقًا في توليد HTML ولقطات الشاشة وملفات GIF مقارنة بـ Claude Opus 4.8.
  • كلف Kimi K3 $0.44 لمجموعة الطلبات الكاملة، وهو مبلغ أقل بكثير من $7.16 الخاصة بـ Opus 4.8.

تشير النتائج إلى أن Kimi K3 ليس أكثر فعالية فقط لمهام النمذجة الواحدة، بل أيضًا أكثر كفاءة في استخدام الرموز وأكثر جدوى من حيث التكلفة مقارنة بالنموذج المنافس.