DeepSeek가 Hugging Face에 DeepSeek-V4-Flash-Vision-Exp 모델 체크포인트를 게시했습니다. 저장소는 이제 공개적으로 접근할 수 있습니다.
DeepSeek, Hugging Face에 DeepSeek-V4-Flash-Vision-Exp 출시
Thinking Machines가 Inkling 출시, Tencent가 Apache 2.0 라이선스로 Hy3 업데이트
최신 오픈 모델 아티팩트 요약에서는 Thinking Machines와 Tencent의 주요 릴리스와 함께 Poolside 및 DeepSeek의 업데이트가 강조됩니다.
Thinking Machines Lab이 오픈 가중치 잉클링 파운데이션 모델을 출시하다
Thinking Machines Lab은 자체 첫 번째 완전 공개 오픈 가중치 파운데이션 모델 패밀리인 잉클링을 출시했습니다. 벤치마크 최고점을 찍는 플래그십 모델이 아닌 사용자 정의 가능한 멀티모달 베이스 모델로 포지셔닝된 잉클링은 텍스트, 이미지, 오디오 입력을 네이티브 멀티모달리티로 지원합니다.
알리바바의 Qwen 팀이 Qwen4를 미리 보여주는 125B MoE인 Qwen3.8-Flash-Next 출시
알리바바의 Qwen 팀은 다가오는 Qwen4 시리즈의 아키텍처를 미리 보여주기 위해 설계된 오픈 가중치 멀티모달 Mixture-of-Experts 모델인 Qwen3.8-Flash-Next를 출시했습니다. 이 체크포인트는 125B 백본과 51B N-gram 임베딩 테이블, 그리고 4B 다중 토큰 예측 모듈을 결합하여 토큰당 6B 파라미터만 활성화합니다.
즈푸 AI가 다중 모달 오픈 가중치 모델인 GLM-5.3-Flash를 출시
즈푸 AI는 GLM-5 시리즈에서 네이티브하게 다중 모달인 첫 번째 모델이자 glm5_next 아키텍처의 첫 번째 오픈 가중치 릴리스인 GLM-5.3-Flash를 출시했습니다. 320B 파라미터 모델은 30T 토큰 다중 모달 코퍼스에서 학습되었으며, 긴 컨텍스트 서빙 비용을 줄이기 위해 하이브리드 희소 및 선형 어텐션 메커니즘을 특징으로 합니다.
ZhiPu, 320B 파라미터의 멀티모달 모델 GLM-5.3-Flash 출시
ZhiPu는 GLM-5 시리즈의 첫 번째 네이티브 멀티모달 모델인 GLM-5.3-Flash를 소개했습니다. 이 모델은 정밀도를 유지하면서 긴 컨텍스트 서빙 비용을 줄이기 위해 희소 및 선형 어텐션을 결합한 하이브리드 아키텍처를 특징으로 합니다.