한 사용자가 DeepSeek V4 Flash 모델을 2, 3, 4비트 양자화된 GGUF 형식으로 변환한 Hugging Face 저장소 링크를 제출했습니다.
- 사용 가능한 모델은 DeepSeek V4 Flash의 2비트, 3비트, 4비트 양자화 버전입니다.
- 파일은 사용자 tarruda의 프로필 아래 Hugging Face 플랫폼에 호스팅되어 있습니다.
한 사용자가 DeepSeek V4 Flash 모델을 2, 3, 4비트 양자화된 GGUF 형식으로 변환한 Hugging Face 저장소 링크를 제출했습니다.
DeepSeek AI는 100만 토큰의 컨텍스트 윈도우와 글로벌 캐시 크기를 토큰당 890바이트로 줄이는 FP4 KV 캐시를 탑재한 멀티모달 Mixture-of-Experts 모델인 DeepSeek-V4.1-Flash를 출시했습니다. 이 모델은 성능을 유지하면서 메모리 요구사항을 크게 낮추기 위해 인코더-디코더 구조와 Compressed Sparse Attention 2(CSA2)를 활용합니다.
DeepSeek-AI는 긴 컨텍스트의 학습 및 추론 효율성을 개선하기 위해 DeepSeek Sparse Attention (DSA)를 도입한 실험용 모델인 DeepSeek-V3.2-Exp를 출시했습니다.
DeepSeek이 새로운 모델 DeepSeek V4-1 Flash을 출시했습니다. 이는 5520억 파라미터의 백본을 갖춘 멀티모달 Mixture-of-Experts (MoE) 모델입니다.
DeepSeek는 네이티브 멀티모달 시각적 이해 기능을 갖춘 새로운 아키텍처 시리즈의 가장 작은 구성 요소인 DeepSeek V4.1 Flash 모델을 공식적으로 출시했습니다. Causal-Encoder-Decoder 설계에 기반한 이 모델은 552B 파라미터를 가진 Mixture of Experts (MoE) 모델로, 입력 측에서는 8B 파라미터만 활성화되고 출력 측에서는 16B가 활성화됩니다.
IFM은 Mixture-of-Values 어텐션을 특징으로 하며 36B의 파라미터를 저장하지만 토큰당 4B만 실행하는 Mixture-of-Experts 모델인 K2-Horizon-MoVA-36B-A4B의 최종 체크포인트를 출시했습니다. 이번 릴리스에는 GGUF 형식과 K2-Horizon 패밀리 내 더 작은 변형체에 대한 링크가 포함되어 있습니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침