Um usuário avaliou o Kimi K3 em comparação ao Claude Opus 4.8, executando 34 prompts de um único exemplo e avaliando o HTML, capturas de tela e GIFs resultantes usando o Sonnet 4.6. A avaliação concluiu que o Kimi K3 produziu resultados melhores do que o Opus 4.8.
- O Kimi K3 foi testado em 34 prompts de um único exemplo, com as saídas avaliadas pelo Sonnet 4.6.
- O modelo demonstrou desempenho superior na geração de HTML, capturas de tela e GIFs em comparação ao Claude Opus 4.8.
- O Kimi K3 custou $0,44 para o conjunto completo de prompts, significativamente menos que os $7,16 do Opus 4.8.
Os resultados sugerem que o Kimi K3 não é apenas mais eficaz para tarefas de geração com um único exemplo, mas também mais eficiente em tokens e custo-benefício em comparação ao modelo concorrente.