Un utilisateur a évalué Kimi K3 par rapport à Claude Opus 4.8 en exécutant 34 prompts en un seul exemple et en évaluant le HTML, les captures d'écran et les GIF résultants à l'aide de Sonnet 4.6. L'évaluation a conclu que Kimi K3 a produit de meilleurs résultats qu'Opus 4.8.

  • Kimi K3 a été testé sur 34 prompts en un seul exemple, avec les sorties évaluées par Sonnet 4.6.
  • Le modèle a démontré des performances supérieures dans la génération de HTML, de captures d'écran et de GIF par rapport à Claude Opus 4.8.
  • Kimi K3 a coûté 0,44 $ pour l'ensemble complet de prompts, significativement moins que les 7,16 $ d'Opus 4.8.

Les résultats suggèrent que Kimi K3 est non seulement plus efficace pour les tâches de génération en un seul exemple, mais aussi plus efficient en termes de tokens et rentable par rapport au modèle concurrent.