Kimi K3, модель с открытыми весами от Moonshot AI, демонстрирует производительность, сопоставимую с Claude Fable 5 от Anthropic на бенчмарке DeepSWE, при этом стоимость за задачу значительно ниже. В оценке от 16 июля 2026 года Kimi K3 достигла результата pass@1 на уровне 68,5% по сравнению с 69,9% у Fable 5, но превзошла её в сценариях с несколькими попытками и обеспечила превосходную эффективность затрат.
- Стоимость Kimi K3 составляет $4,65 за rollout против $13,41 для Claude Fable 5, что обеспечивает в 2,8 раза больше решённых задач на доллар.
- Хотя Fable 5 лидирует по надёжности при одной попытке (69,9% против 68,5%), Kimi K3 выигрывает по pass@2 (82,0% против 80,2%) и pass@4 (89,4% против 88,5%).
- Kimi K3 охватывает более широкий спектр задач, решая 101 уникальную задачу по сравнению с 107 у Fable 5, демонстрируя сильную производительность в Go.
Модели показывают высокую корреляцию (0,72) и схожие паттерны ошибок, что означает отсутствие значимого разнообразия при их совместном использовании.
Kimi K3 позиционируется как рациональный выбор по умолчанию для высоконагруженных или допускающих повторные попытки задач агентов благодаря своим открытым весам и более низкой стоимости, несмотря на незначительное преимущество Fable 5 в надёжности при одной попытке.