연구소 · Alibaba (Qwen)
media AI News (smol.ai) · 10일 전 Terminal-Bench 2 · 67.4% · 조회수 21회

알리바바, 2.4T 파라미터를 갖춘 Qwen3.8-Max와 향후 오픈 가중치 발표

알리바바는 새로운 플래그십 모델인 Qwen3.8-Max를 발표했으며, 이는 장기적 에이전트 작업, 코딩, 다중 모달 추론에 중점을 둔 2.4T 파라미터의 희소 아키텍처라고 설명했습니다. 회사는 다음 주 Qwen3.8-27B 변형과 함께 Qwen3.8-Max의 오픈 가중치를 출시할 것이라고 확인했습니다.

lab Hugging Face Blog · 9시간 전 · 조회수 2회

오픈 모델의 현황: 2026년 여름 관측

2026년 초 Hugging Face Hub 데이터를 분석한 보고서에 따르면, 중국 연구소들이 최전선 오픈 모델 규모에서 미국 연구소들을 추월했으며, NVIDIA와 AMD 같은 하드웨어 벤더들이 새로운 리포지토리 출시를 주도하고 있다. 이 분석은 커뮤니티의 관심(좋아요)과 실제 채택(다운로드) 사이의 괴리를 강조하며, 소규모 모델이 로컬 추론을 위한 실용적인 표준으로 남아있음을 보여준다.

arxiv arXiv cs.LG · 4일 전 · 조회수 2회

Macaron-V1이 Mixture-of-LoRA를 활용한 지속 학습용 오픈 에이전트 모델 패밀리 출시

Macaron-V1은 실제 환경에서 학습하고 배포 후에도 학습을 계속할 수 있도록 설계된 경험적 지능용 오픈 에이전트 모델 패밀리입니다. 이 시스템은 두 가지 목표에 중점을 둡니다: 모델-하arness 쌍의 재귀적 개선을 통한 적응과, 사용자 턴마다 전문가 LoRA 어댑터를 선택하는 Mixture-of-LoRA (MoL) 아키텍처를 통한 협업.

arxiv arXiv cs.CL · 4일 전 · 조회수 10회

Macaron-V1이 지속적 학습을 위한 Mixture-of-LoRA와 함께 오픈 에이전트 모델 패밀리 출시

Macaron-V1은 경험적 지능을 위해 설계된 오픈 에이전트 모델 패밀리로, 시스템이 실제 세계의 경험으로부터 학습하고 배포 후에도 지속적으로 개선할 수 있도록 합니다. 이 아키텍처는 두 가지 목표를 중심으로 합니다: 모델-하니스 쌍의 재귀적 자기 개선을 통한 적응과, 사용자 턴마다 전문가 어댑터를 선택하는 Mixture-of-LoRA(MoL) 시스템을 통한 협업.