v0.29.0rc2 릴리스에는 접두사 덮개 항목을 적절히 처리하기 위한 SHM 작업자 캐시의 버그 수정이 포함되어 있습니다.
- SHM 작업자 캐시에서 접두사 덮개 항목이 올바르게 처리되지 않던 문제를 해결합니다.
v0.29.0rc2 릴리스에는 접두사 덮개 항목을 적절히 처리하기 위한 SHM 작업자 캐시의 버그 수정이 포함되어 있습니다.
DeepSeek가 Hugging Face에 DeepSeek-V4-Flash-Vision-Exp 모델 체크포인트를 게시했습니다. 저장소는 이제 공개적으로 접근할 수 있습니다.
알리바바의 Qwen 팀은 다가오는 Qwen4 시리즈의 아키텍처를 미리 보여주기 위해 설계된 오픈 가중치 멀티모달 Mixture-of-Experts 모델인 Qwen3.8-Flash-Next를 출시했습니다. 이 체크포인트는 125B 백본과 51B N-gram 임베딩 테이블, 그리고 4B 다중 토큰 예측 모듈을 결합하여 토큰당 6B 파라미터만 활성화합니다.
즈푸 AI는 GLM-5 시리즈에서 네이티브하게 다중 모달인 첫 번째 모델이자 glm5_next 아키텍처의 첫 번째 오픈 가중치 릴리스인 GLM-5.3-Flash를 출시했습니다. 320B 파라미터 모델은 30T 토큰 다중 모달 코퍼스에서 학습되었으며, 긴 컨텍스트 서빙 비용을 줄이기 위해 하이브리드 희소 및 선형 어텐션 메커니즘을 특징으로 합니다.
Zai는 GLM-5 시리즈의 첫 번째 네이티브 다중 모달 모델인 GLM-5.3-Flash를 소개했습니다. 긴 컨텍스트 서빙 비용을 줄이면서도 정확한 기능을 유지하기 위해 희소 및 선형 어텐션을 결합한 하이브리드 아키텍처를 특징으로 합니다.
ZhiPu는 GLM-5 시리즈의 첫 번째 네이티브 멀티모달 모델인 GLM-5.3-Flash를 소개했습니다. 이 모델은 정밀도를 유지하면서 긴 컨텍스트 서빙 비용을 줄이기 위해 희소 및 선형 어텐션을 결합한 하이브리드 아키텍처를 특징으로 합니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침