Un utilisateur a développé une implémentation personnalisée permettant d'exécuter le modèle DeepSeek V4.1 sur des GPU NVIDIA A100 avec des performances supérieures à celles de l'API officielle.

  • Le projet est disponible via le dépôt GitHub shi3z/deepseekv4.1-A100-custom.
  • Cette réalisation est notable car le matériel A100 ne prend pas nativement en charge la précision FP4, qui est généralement requise pour ce type d'optimisations.
  • Le code personnalisé permet des vitesses d'inférence plus rapides par rapport au point de terminaison officiel standard.