DeepSeek는 독립 벤치마크에서 더 큰 DeepSeek-V4-Pro를 능가하는 소형 "Flash" 모델의 업데이트 버전인 DeepSeek-V4-Flash-0731을 출시했습니다. 이번 릴리스는 원래 2,840억 개의 총 파라미터를 가진 Mixture-of-Experts 아키텍처를 유지하면서 새로운 파인튜닝 프로세스를 활용합니다.

  • 이 모델은 Artificial Analysis의 Intelligence Index에서 Gemini 3.6 Flash와 동점인 50점을 기록했으며, GPT-5.6 Luna와 GLM-5.2에만 뒤처집니다.
  • 벤치마크에서 작업당 비용이 $0.03로 GPT-5.6 Luna의 $0.05보다 저렴하여 지능 대비 비용 측면에서 파레토 최적 경계에 위치합니다.
  • 에이전트 기능이 크게 향상되어 GDPval-AA에서 1,558 Elo를 기록하고 Terminal-Bench 2.1에서 문제의 82.7%를 해결했습니다.
  • 가중치는 MIT 라이선스 하에 제공되며, API 가격은 백만 입력 토큰당 $0.14로 책정되었습니다.

이번 업데이트는 고객 서비스 및 버그 분류와 같은 항상 활성화된 작업에 대해 고지능 모델을 소유형 모델 접근 없이도 경제적으로 배포할 수 있음을 보여줍니다.