Una comparación de DeepSeek V4 Pro 0813 y Claude Fable 5 en el benchmark DeepSWE revela que una estrategia de enrutamiento que utiliza ambos modelos resuelve el 82,7 % de las tareas a $8,28 cada una, superando a Fable por sí solo (69,7 %) mientras es significativamente más económica.
- Claude Fable 5 lidera en precisión de intento único (69,7 % pass@1) y destaca en Rust (85 %) y trabajo intensivo en serialización, pero cuesta $21,63 por rollout, aproximadamente 90 veces más que DeepSeek V4 Pro 0813.
- DeepSeek V4 Pro 0813 es más económico ($0,24 por rollout) y logra mayor precisión con múltiples intentos (88,5 % pass@4 frente al 84,1 % de Fable), lo que lo convierte en la mejor opción para trabajo de alto volumen o tolerante a reintentos.
- Los modelos muestran baja correlación por tarea (0,39), cubriendo 107 de 113 tareas entre ellos, lo que justifica un enfoque en cascada: ejecutar Pro primero y escalar a Fable solo cuando sea necesario.
El análisis sugiere que Fable 5 se usa mejor como una escalación selectiva para dominios específicos como Rust en lugar de un modelo predeterminado, mientras que DeepSeek V4 Pro 0813 ofrece precisión cercana a la de Fable a una fracción del costo.