A DeepSeek lançou o DeepSeek-Coder-V2, um modelo de linguagem de código de Mistura de Especialistas (MoE) de código aberto que alcança desempenho comparável ao do GPT-4 Turbo em tarefas específicas de codificação. O modelo é pré-treinado adicionalmente a partir de um checkpoint intermediário do DeepSeek-V2 usando 6 trilhões de tokens adicionais.

  • Aprimora as capacidades de raciocínio de codificação e matemática, mantendo o desempenho geral da linguagem.
  • Expande o suporte a linguagens de programação de 86 para 338 idiomas.
  • Estende o comprimento do contexto de 16K para 128K.
  • Supera modelos fechados como GPT-4 Turbo, Claude 3 Opus e Gemini 1.5 Pro em benchmarks de codificação e matemática.

Este lançamento fornece uma alternativa aberta de alto desempenho para inteligência de código, oferecendo avanços significativos em relação ao seu antecessor DeepSeek-Coder-33B.