Qwen 팀이 Qwen3.8-Flash-Next 모델을 출시했으며, 이제 ModelScope에서 사용할 수 있습니다.
이번 릴리스로 Qwen3.8-Flash 시리즈에 새로운 변형이 추가되었습니다.
Qwen 팀이 Qwen3.8-Flash-Next 모델을 출시했으며, 이제 ModelScope에서 사용할 수 있습니다.
이번 릴리스로 Qwen3.8-Flash 시리즈에 새로운 변형이 추가되었습니다.
Ant Group는 주요 금융 기관 및 도메인 전문가와 함께 개발한 Ant Ling 패밀리 최초의 금융 강화 모델인 Ling-3.0-flash-Fin의 소스를 공개했습니다.
Alibaba는 대규모 언어 모델인 Qwen3.8-Max-0902의 업그레이드 버전을 출시했습니다. 새로운 모델은 2.4조 개의 파라미터를 특징으로 하며 100만 토큰의 컨텍스트 창을 지원합니다.
이번 주 AI 뉴스는 Z.ai, 텐센트, 알리바바의 주요 오픈 가중치 모델 출시와 추론 인프라 및 에이전트 벤치마킹 관련 발전을 강조합니다.
알리바바의 Qwen 팀은 다가오는 Qwen4 시리즈의 아키텍처를 미리 보여주기 위해 설계된 오픈 가중치 멀티모달 Mixture-of-Experts 모델인 Qwen3.8-Flash-Next를 출시했습니다. 이 체크포인트는 125B 백본과 51B N-gram 임베딩 테이블, 그리고 4B 다중 토큰 예측 모듈을 결합하여 토큰당 6B 파라미터만 활성화합니다.
저자들은 Quantization-Aware Healing (QAH)을 소개했습니다. 이는 구조적 압축 및 양자화 동안 손실된 성능을 회복하기 위해 비압축 모델에서 직접 4비트 학생 모델을 증류하는 파이프라인입니다. GPT-OSS 120B에 적용하면 이 방법은 Hypernova-60B를 생성하며, 9개 벤치마크 중 7개에서 bfloat16 소스와 동등하거나 더 나은 성능을 보이며 가중치 메모리를 약 4배 적게 사용합니다.
트래픽 측정과 사이트 개선을 위해 쿠키를 사용합니다. 분석 쿠키를 허용하거나 거부할 수 있습니다. 개인정보처리방침