Seorang pengguna mengevaluasi Kimi K3 terhadap Claude Opus 4.8 dengan menjalankan 34 prompt satu-sentuhan dan menilai HTML, tangkapan layar, dan GIF yang dihasilkan menggunakan Sonnet 4.6. Evaluasi menyimpulkan bahwa Kimi K3 menghasilkan hasil yang lebih baik daripada Opus 4.8.
- Kimi K3 diuji pada 34 prompt satu-sentuhan dengan output yang dievaluasi oleh Sonnet 4.6.
- Model tersebut menunjukkan kinerja unggul dalam menghasilkan HTML, tangkapan layar, dan GIF dibandingkan Claude Opus 4.8.
- Kimi K3 menghabiskan $0,44 untuk seluruh set prompt, jauh lebih sedikit daripada $7,16 milik Opus 4.8.
Hasilnya menunjukkan bahwa Kimi K3 tidak hanya lebih efektif untuk tugas generasi satu-sentuhan, tetapi juga lebih efisien token dan hemat biaya dibandingkan model pesaing.