Un usuario ha desarrollado una implementación personalizada que permite ejecutar el modelo DeepSeek V4.1 en GPUs NVIDIA A100 con un rendimiento que supera a la API oficial.

  • El proyecto está disponible a través del repositorio de GitHub shi3z/deepseekv4.1-A100-custom.
  • Este logro es notable porque el hardware A100 no admite nativamente la precisión FP4, que normalmente se requiere para estas optimizaciones.
  • El código personalizado permite velocidades de inferencia más rápidas en comparación con el punto final oficial estándar.