Qwen이 Qwen3.8-27B 모델을 출시했으며, ModelScope와 Hugging Face에서 다운로드할 수 있습니다.
이번 출시에는 이전 버전과 다른 로컬 옵션을 새 모델과 비교하는 성능 차트가 포함되어 있습니다. 원문은 텍스트 및 비전 작업 모두에서 모델의 능력을 강조합니다.
Qwen이 Qwen3.8-27B 모델을 출시했으며, ModelScope와 Hugging Face에서 다운로드할 수 있습니다.
이번 출시에는 이전 버전과 다른 로컬 옵션을 새 모델과 비교하는 성능 차트가 포함되어 있습니다. 원문은 텍스트 및 비전 작업 모두에서 모델의 능력을 강조합니다.
알리바바는 새로운 플래그십 모델인 Qwen3.8-Max를 발표했으며, 이는 장기적 에이전트 작업, 코딩, 다중 모달 추론에 중점을 둔 2.4T 파라미터의 희소 아키텍처라고 설명했습니다. 회사는 다음 주 Qwen3.8-27B 변형과 함께 Qwen3.8-Max의 오픈 가중치를 출시할 것이라고 확인했습니다.
Qwen3.8-Max (2.4T)는 모든 벤치마크 카테고리에서 Kimi K3 및 DeepSeek V4 Flash에 근접한 성능을 보이며, 코딩 및 소프트웨어 작업에서는 더 우수한 성능을 입증하는 새로운 오픈 가중치 모델입니다.
Qwen 3.8-Max가 출시되었으며 현재 Claude Fable 5 Max에 이어 Vision Arena 리더보드에서 #2위를 차지하고 있습니다.
InternScience는 Qwen3.5-4B을 기반으로 하며, 매개변수 수를 증가시키지 않고 장기 호라이즌 검색 및 에이전트 워크플로우의 성능을 향상시키기 위해 설계된 밀집 모델 Agents-A1-4B을 출시했습니다.
알리바바 클라우드는 기존 0.5B에서 72B 파라미터에 이르는 라인업에 3B, 14B, 32B의 세 가지 새로운 크기를 추가하여 디코더 전용 밀집 언어 모델인 Qwen2.5 시리즈를 오픈소스로 공개했습니다. 이번 업데이트는 사전 학습 데이터셋을 7조 토큰에서 18조 토큰으로 확장하고, Qwen2.5-Coder와 Qwen-math의 기술적 돌파구를 통합하여 코딩, 수학, 일반 지식 분야에서 성능을 크게 개선했습니다.