NVIDIA가 Hugging Face에 Nemotron-3.5-Lightning-30B-A3B 모델을 출시했습니다.
체크포인트는 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16 식별자 아래에서 사용할 수 있습니다.
NVIDIA가 Hugging Face에 Nemotron-3.5-Lightning-30B-A3B 모델을 출시했습니다.
체크포인트는 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16 식별자 아래에서 사용할 수 있습니다.
알리바바는 오픈 생태계에 최전선 수준의 능력을 제공하도록 설계된 가장 큰 오픈 가중치 모델인 Qwen3.8-2.4T-A95B(Qwen3.8-Max로도 알려짐)의 오픈 가중치를 출시했습니다.
NVIDIA는 항상 켜져 있는 AI 에이전트를 구축하기 위해 설계된 두 가지 오픈소스 아티팩트인 Nemotron 3.5 Lightning 모델과 NeMo Switchyard 라우팅 라이브러리를 출시했습니다. 이 도구들은 긴 실행 중인 에이전트 워크플로우의 모든 단계를 최첨단 추론 모델로 전송하는 데 따른 높은 비용과 지연 시간을 전문화된 실행 및 라우팅 기능을 제공하여 해결합니다.
NVIDIA는 Magpie 다국어 TTS 모델의 업데이트를 출시하여 현대 표준 아랍어, 한국어, 브라질 포르투갈어를 추가해 총 12개 언어로 지원을 확대했습니다. 이번 릴리스는 업데이트된 학습 데이터와 아키텍처 변경을 통해 기존 언어 전반에 걸쳐 품질을 개선했습니다.
Meta는 로컬 AI 에이전트 작업을 위해 설계된 120K+ 컨텍스트 윈도우를 가진 30B 밀집 모델인 Muse Glimmer을 출시했습니다. NVIDIA 엣지, 데스크톱 및 워크스테이션 플랫폼에서 실행하도록 최적화되어 단일 GPU에서 초당 20K 토큰을 제공합니다.
NVIDIA는 실시간 풀듀플렉스 대화를 위해 설계된 오픈 11B 파라미터 엔드투엔드 음성-음성 모델인 NemotronLabs VoiceChat 11B를 출시했습니다. ASR, LLM 및 TTS를 체이닝하는 캐스케이디드 스택과 달리, 이 통합 네트워크는 스트리밍 음성을 동시에 이해하고 생성하며, Full-Duplex-Bench 1.0에서 측정된 부드러운 턴테이킹 지연시간은 448ms입니다.