Un usuario evaluó Kimi K3 frente a Claude Opus 4.8 ejecutando 34 prompts de un solo ejemplo y evaluando el HTML, capturas de pantalla y GIF resultantes utilizando Sonnet 4.6. La evaluación concluyó que Kimi K3 produjo mejores resultados que Opus 4.8.
- Kimi K3 fue probado con 34 prompts de un solo ejemplo, cuyas salidas fueron evaluadas por Sonnet 4.6.
- El modelo demostró un rendimiento superior en la generación de HTML, capturas de pantalla y GIF en comparación con Claude Opus 4.8.
- Kimi K3 costó $0.44 por el conjunto completo de prompts, significativamente menos que los $7.16 de Opus 4.8.
Los resultados sugieren que Kimi K3 no solo es más efectivo para tareas de generación con un solo ejemplo, sino también más eficiente en tokens y rentable en comparación con el modelo competidor.