DeepSeek a lancé DeepSeek-Coder-V2, un modèle de langage de code open-source à mélange d'experts (MoE) qui atteint des performances comparables à celles de GPT-4 Turbo dans des tâches spécifiques au codage. Le modèle est pré-entraîné supplémentairement à partir d'un point de contrôle intermédiaire de DeepSeek-V2 en utilisant 6 billions de tokens supplémentaires.
- Améliore les capacités de raisonnement en codage et en mathématiques tout en maintenant les performances linguistiques générales.
- Élargit le support des langages de programmation de 86 à 338 langues.
- Étend la longueur du contexte de 16K à 128K.
- Surpasse les modèles fermés tels que GPT-4 Turbo, Claude 3 Opus et Gemini 1.5 Pro dans les benchmarks de codage et de mathématiques.
Cette version fournit une alternative open-source haute performance pour l'intelligence du code, offrant des avancées significatives par rapport à son prédécesseur DeepSeek-Coder-33B.