DeepSeek는 DeepSeek-V4-Flash-Vision-Exp이라는 실험용 멀티모달 비전 이해 모델을 출시했으며, 이제 DeepSeek API 플랫폼에서 사용할 수 있습니다. 이 새로운 모델은 텍스트 전용 대응 모델과 동등성을 유지하면서 시각적 능력을 향상시키기 위해 설계되었습니다.

  • 모델은 모델 매개변수를 'deepseek-v4-flash-vision-exp'로 설정하여 API를 통해 액세스할 수 있습니다.
  • 비전 이해가 필요한 에이전트 벤치마크에서 상당한 개선을 달성하여 멀티모달 에이전트 능력을 Opus-4.8에 가깝게 만듭니다.
  • 에이전트, 추론 및 세계 지식과 같은 순수 텍스트 능력 측면에서 공식 DeepSeek-V4-Flash와 동등하게 작동합니다.
  • 벤치마크 점수에는 Terminal Bench 2.1에서 83.9, Chartography에서 64.3, DSBench-Hard에서 59.3이 포함됩니다.

이번 릴리스는 DeepSeek-V4-Flash 모델의 강력한 텍스트 기반 성능을 유지하면서 멀티모달 작업을 위한 새로운 도구를 사용자에게 제공합니다.