DeepSeek는 코딩 특정 작업에서 GPT-4 Turbo와 비교 가능한 성능을 달성하는 오픈소스 Mixture-of-Experts (MoE) 코드 언어 모델인 DeepSeek-Coder-V2를 출시했습니다. 이 모델은 DeepSeek-V2의 중간 체크포인트에서 추가 6조 개의 토큰을 사용하여 추가로 사전 훈련되었습니다.

  • 일반적인 언어 성능을 유지하면서 코딩 및 수학적 추론 능력을 향상시킵니다.
  • 프로그래밍 언어 지원을 86개에서 338개로 확장합니다.
  • 컨텍스트 길이를 16K에서 128K로 연장합니다.
  • 코딩 및 수학 벤치마크에서 GPT-4 Turbo, Claude 3 Opus, Gemini 1.5 Pro와 같은 클로즈드 소스 모델을 능가합니다.

이번 릴리스는 코드 인텔리전스를 위한 고성능 오픈 대안을 제공하며, 전신인 DeepSeek-Coder-33B에 비해 상당한 진전을 제공합니다.