사용자 Achilles1089가 Hugging Face에 무검열 "fable and opus 4.8" 하이브리드 모델을 업로드했으며, 해당 수치가 그 효과를 입증한다고 주장했습니다.
이 모델은.
사용자 Achilles1089가 Hugging Face에 무검열 "fable and opus 4.8" 하이브리드 모델을 업로드했으며, 해당 수치가 그 효과를 입증한다고 주장했습니다.
이 모델은.
알리바바의 Qwen 팀은 코딩, 장기 에이전트 작업, 다중 모달 추론에 중점을 둔 새로운 2.4T 파라미터 플래그십 모델인 Qwen 3.8 Max를 발표했습니다. 회사는 Qwen 3.8 Max와 소규모 Qwen 3.8-27B의 오픈 가중치 버전이 내주 출시될 것이라고 확인했습니다.
알리바바는 2.4조 파라미터를 가진 Qwen3.8의 오픈 가중치 출시를 발표했으며, 엔비디아 CUDA 생태계 의존도를 줄이기 위해 Zhenwu AI 칩 소프트웨어 스택도 오픈소스로 공개했다.
알리바바는 270억 개의 파라미터를 가진 새로운 밀집형 오픈소스 모델인 Qwen3.6-27B를 출시했습니다. 이 모델은 테스트된 거의 모든 코딩 벤치마크에서 훨씬 더 큰 후속 모델인 Qwen3.5-397B-A17B보다 우수한 성능을 보였습니다.
알리바바의 Qwen 팀은 2025년 7월 추론 시 350억 파라미터만 활성화되는 4800억 파라미터 Mixture-of-Experts 모델인 'Qwen3-Coder-480B-A35B-Instruct'를 출시했습니다. 이 모델은 Apache 2.0 라이선스 하에 완전히 오픈소스이며, Claude Sonnet 4 및 GPT-4와 비교 가능한 코딩 성능을 달성합니다.
Qwen 팀은 Qwen2.5 아키텍처에서 파생된 새로운 코드 전용 언어 모델 세트인 Qwen2.5-Coder 시리즈를 소개했습니다. 이 시리즈에는 0.5B에서 32B 파라미터에 이르는 여섯 가지 모델 크기가 포함되어 있으며, 정제된 소스 코드와 합성 데이터 5.5조 토큰 이상으로 학습되었습니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침