Un usuario ha desarrollado una implementación personalizada que permite ejecutar el modelo DeepSeek V4.1 en GPUs NVIDIA A100 con un rendimiento que supera a la API oficial.
- El proyecto está disponible a través del repositorio de GitHub shi3z/deepseekv4.1-A100-custom.
- Este logro es notable porque el hardware A100 no admite nativamente la precisión FP4, que normalmente se requiere para estas optimizaciones.
- El código personalizado permite velocidades de inferencia más rápidas en comparación con el punto final oficial estándar.