DeepSeek는 DeepSeek-V4-Flash 모델을 업데이트했으며 DeepSeek-V4-Pro의 공식 출시가 곧 있을 것이라고 발표했습니다.
이 업데이트는 회사의 API 문서 업데이트 페이지를 통해 확인되었습니다.
DeepSeek는 DeepSeek-V4-Flash 모델을 업데이트했으며 DeepSeek-V4-Pro의 공식 출시가 곧 있을 것이라고 발표했습니다.
이 업데이트는 회사의 API 문서 업데이트 페이지를 통해 확인되었습니다.
Reddit 토론에 따르면 DeepSeek v4 플래시 릴리스 버전은 초기 미리보기 단계 이후 API에서 활성화되었을 가능성이 있습니다. 이 시기는 7월 중순으로 예정된 오픈 가중치와 일치합니다.
DeepSeek는 총 671B 파라미터를 가지며 토큰당 37B가 활성화되는 강력한 Mixture-of-Experts (MoE) 언어 모델인 DeepSeek-V3를 출시했습니다. 이 모델은 Multi-head Latent Attention과 보조 손실 없는 부하 균형 전략을 활용하며, FP8 혼합 정밀도로 14.8조 개의 토큰을 사용하여 훈련되었습니다.
DeepSeek-V4-Flash의 공식 릴리스가 DeepSeek API에서 이제 사용 가능합니다.
LG AI Research는 한국의 주권형 AI 파운데이션 모델 프로젝트의 2단계 개발을 통해 구축된 750B 파라미터 모델인 K-EXAONE 2.0을 출시했습니다.
Together AI는 Moonshot의 오픈 가중치 모델을 위한 런치 플랫폼으로 기능하기 위해 Moonshot AI와의 전략적 파트너십을 발표했습니다. 첫 번째로 Kimi K3가 제공됩니다. 이 협력을 통해 개발자는 Together AI의 미국 호스팅 인프라와 도구를 통해 프론티어 릴리스에 제로 데이 접근 권한을 얻게 됩니다.