DeepSeek a lancé DeepSeek-Coder-V2, un modèle de langage de code open-source à mélange d'experts (MoE) qui atteint des performances comparables à celles de GPT-4 Turbo dans des tâches spécifiques au codage. Le modèle est pré-entraîné supplémentairement à partir d'un point de contrôle intermédiaire de DeepSeek-V2 en utilisant 6 billions de tokens supplémentaires.

  • Améliore les capacités de raisonnement en codage et en mathématiques tout en maintenant les performances linguistiques générales.
  • Élargit le support des langages de programmation de 86 à 338 langues.
  • Étend la longueur du contexte de 16K à 128K.
  • Surpasse les modèles fermés tels que GPT-4 Turbo, Claude 3 Opus et Gemini 1.5 Pro dans les benchmarks de codage et de mathématiques.

Cette version fournit une alternative open-source haute performance pour l'intelligence du code, offrant des avancées significatives par rapport à son prédécesseur DeepSeek-Coder-33B.