DeepSeek는 전작인 DeepSeek-V3 대비 뚜렷한 개선을 보인 모델 업데이트인 DeepSeek-V3-0324을 출시했으며, 특히 추론 능력, 코드 실행 가능성, 중국어 작문 숙련도에서 두드러진 향상이 확인되었습니다.

  • MMLU-Pro 점수가 75.9에서 81.2로, GPQA는 59.1에서 68.4로, AIME는 39.6에서 59.4로, LiveCodeBench는 39.2에서 49.2로 각각 상승했습니다.
  • 코드 실행 가능성과 미적 완성도를 개선하여 프론트엔드 웹 개발 출력을 강화했습니다.
  • R1과 스타일을 맞추도록 중국어 작문 스타일을 최적화하고 중·장문 콘텐츠의 품질을 개선했습니다.
  • 이전 V3 버전에서 존재하던 함수 호출 정확도 문제를 수정하고 다중 대화 상호작용 재작성 기능을 강화했습니다.

이 업데이트는 Transformers, vLLM, SGLang과 같은 라이브러리를 사용하는 개발자에게 더 나은 벤치마크 성능과 신뢰할 수 있는 함수 호출을 제공합니다.