xAI가 Grok 4.6 출시, 알리바바가 Qwen3.8-Max 공개, DeepSeek V4 Pro GA 발표
xAI는 장기 실행 에이전트와 상호작용 작업에 중점을 둔 1.5T 모델인 Grok 4.6을 출시했으며, 알리바바는 오픈 가중치 Qwen3.8-Max를 공개하고 DeepSeek는 공격적인 가격으로 V4 Pro를 일반적으로 사용 가능하게 만들었습니다.
xAI는 장기 실행 에이전트와 상호작용 작업에 중점을 둔 1.5T 모델인 Grok 4.6을 출시했으며, 알리바바는 오픈 가중치 Qwen3.8-Max를 공개하고 DeepSeek는 공격적인 가격으로 V4 Pro를 일반적으로 사용 가능하게 만들었습니다.
이번 주 AI 뉴스는 xAI, 알리바바, DeepSeek의 주요 릴리스와 함께 오픈 비디오 모델 및 추론 인프라 업데이트를 강조합니다.
알리바바는 새로운 플래그십 모델인 Qwen3.8-Max를 발표했으며, 이는 장기적 에이전트 작업, 코딩, 다중 모달 추론에 중점을 둔 2.4T 파라미터의 희소 아키텍처라고 설명했습니다. 회사는 다음 주 Qwen3.8-27B 변형과 함께 Qwen3.8-Max의 오픈 가중치를 출시할 것이라고 확인했습니다.
알리바바의 Qwen 팀은 코딩, 장기 에이전트 작업, 다중 모달 추론에 중점을 둔 새로운 2.4T 파라미터 플래그십 모델인 Qwen 3.8 Max를 발표했습니다. 회사는 Qwen 3.8 Max와 소규모 Qwen 3.8-27B의 오픈 가중치 버전이 내주 출시될 것이라고 확인했습니다.
알리바바의 Qwen 팀은 API를 통해 Qwen3.8-Max를 광범위하게 공개했으며, 차주에 Qwen3.8-Max와 더 작은 체크포인트인 Qwen3.8-27B의 오픈 가중치가 출시될 예정입니다. 플래그십 모델은 텍스트, 이미지, 비디오 입력을 수용하는 2.4조 파라미터의 mixture-of-experts 아키텍처입니다.
구글은 효율적인 범용 에이전트 워크로드를 위한 Gemini 3.6 Flash, 낮은 지연 시간 애플리케이션을 위한 3.5 Flash-Lite, 그리고 CodeMender와 통합된 사이버 전문 3.5 Flash 모델을 포함한 세 가지 새로운 모델을 출시했습니다.
7월 19일, 알리바바의 Qwen 팀은 2.4조 개의 파라미터를 가진 새로운 플래그십 다중 모달 모델인 Qwen3.8-Max-Preview를 미리 선보였습니다. 이 발표는 상하이에서 열린 월드 AI 컨퍼런스 동안 이루어졌으며, Moonshot AI가 Kimi K3 모델을 출시한 지 이틀 만에 발표되었습니다.
2026년 초 Hugging Face Hub 데이터를 분석한 보고서에 따르면, 중국 연구소들이 최전선 오픈 모델 규모에서 미국 연구소들을 추월했으며, NVIDIA와 AMD 같은 하드웨어 벤더들이 새로운 리포지토리 출시를 주도하고 있다. 이 분석은 커뮤니티의 관심(좋아요)과 실제 채택(다운로드) 사이의 괴리를 강조하며, 소규모 모델이 로컬 추론을 위한 실용적인 표준으로 남아있음을 보여준다.
Qwen이 자체 Qwen 3.8 27B 모델의 오픈 가중치를 출시했습니다. 체크포인트는 Hugging Face에서 사용할 수 있습니다.
Qwen이 Qwen3.8-27B 모델을 출시했으며, ModelScope와 Hugging Face에서 다운로드할 수 있습니다.
지난달 중국에서 네 개의 대규모 언어 모델이 출시되었습니다: Kimi K3-2.8T, Qwen3.8-2.4T, DeepSeek-V4-Pro-0813-1.6T, GLM-5.3-743B.
Qwen 3.8 Max의 전체 출시는 이 모델이 매우 빠르고 계획 능력이 뛰어나며 문제에서 불필요한 복잡성을 식별하는 데 능숙하다는 초기 인상을 확인합니다.
알리바바는 오픈 생태계에 최전선 수준의 능력을 제공하도록 설계된 가장 큰 오픈 가중치 모델인 Qwen3.8-2.4T-A95B(Qwen3.8-Max로도 알려짐)의 오픈 가중치를 출시했습니다.
Qwen3.8-24T 모델이 출시되었으며 이제 Hugging Face에서 사용할 수 있습니다.
Macaron-V1은 실제 환경에서 학습하고 배포 후에도 학습을 계속할 수 있도록 설계된 경험적 지능용 오픈 에이전트 모델 패밀리입니다. 이 시스템은 두 가지 목표에 중점을 둡니다: 모델-하arness 쌍의 재귀적 개선을 통한 적응과, 사용자 턴마다 전문가 LoRA 어댑터를 선택하는 Mixture-of-LoRA (MoL) 아키텍처를 통한 협업.
Macaron-V1은 경험적 지능을 위해 설계된 오픈 에이전트 모델 패밀리로, 시스템이 실제 세계의 경험으로부터 학습하고 배포 후에도 지속적으로 개선할 수 있도록 합니다. 이 아키텍처는 두 가지 목표를 중심으로 합니다: 모델-하니스 쌍의 재귀적 자기 개선을 통한 적응과, 사용자 턴마다 전문가 어댑터를 선택하는 Mixture-of-LoRA(MoL) 시스템을 통한 협업.
Artificial Analysis는 에이전틱 인덱스를 업데이트하여 Qwen 3.8 Max를 최고의 전체 모델로 평가하고 Opus 5보다 위에 배치했습니다.
이 뉴스레터는 OpenAI의 상당한 가격 변동, Alibaba의 새로운 모델 출시, Google DeepMind의 주요 경영진 변화 등 AI 산업의 최근 발전을 다룹니다.
Qwen3.8-2.4T-A95B 모델(일명 Qwen3.8-Max)은 다음 수요일에 오픈 릴리스될 예정입니다.
2026년 8월 3-4일자 AI 뉴스 요약에서는 Alibaba Qwen, NVIDIA, Mistral AI, Black Forest Labs의 주요 모델 출시와 에이전트 라우팅, 인프라, 사이버 보안 분야의 동향을 다룹니다.