DeepSeek는 극한의 추론 효율성과 낮은 비용을 위해 설계된 새로운 오픈 가중치 플래그십 모델인 V4.1-Flash를 출시했습니다. 이 모델은 활성화된 컴퓨팅과 KV/캐시 비용을 크게 줄이기 위해 인과적 인코더-디코더 아키텍처를 활용합니다.
- Artificial Analysis Intelligence Index에서 40점을 기록하여 DeepSeek V4 Pro 0813을 능가하며, 1M 입력 토큰당 $0.30의 비용을 지닙니다.
- 이 아키텍처는 총 763B의 파라미터를 가지며, 입력에는 8B만 활성화되고 출력에는 16B가 활성화됩니다.
- MIT 라이선스 하에 1M 토큰 컨텍스트 윈도우를 지원하며 텍스트와 이미지 입력을 모두 수용합니다.
- 독립적인 평가 결과 AutomationBench-AA에서 GPT-6 Astra와 동점인 69%를 기록했으며, AA-LCR v1.1에서 GPT-5.6 Sol과 동점인 84%를 달성했습니다.
- 사용자는 컴퓨팅 하드웨어에서 로컬로 모델을 실행하며 SSD 스트리밍과 오프로딩을 통해 높은 처리량을 달성했다고 보고합니다.
이번 출시로 V4.1-Flash는 독점 모델에 대한 비용 효율적인 대안으로 자리 잡았으며, 가격의 극히 일부로 강력한 성능 지표를 제공합니다.