NVIDIA 已在 Hugging Face 上发布了 Nemotron-3.5-Lightning-30B-A3B 模型。
该 checkpoint 的标识符为 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16。
NVIDIA 已在 Hugging Face 上发布了 Nemotron-3.5-Lightning-30B-A3B 模型。
该 checkpoint 的标识符为 nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16。
阿里巴巴发布了其最大开源模型 Qwen3.8-2.4T-A95B(也称为 Qwen3.8-Max)的开源权重,旨在为开放生态带来接近前沿的能力。
NVIDIA发布了两个旨在构建全天候AI智能体的开源组件:Nemotron 3.5 Lightning模型和NeMo Switchyard路由库。这些工具通过提供专门的执行和路由能力,解决了将长运行智能体工作流的每一步都发送到前沿推理模型所带来的高昂成本和延迟问题。
NVIDIA 已对其 Magpie Multilingual TTS 模型发布更新,通过新增现代标准阿拉伯语、韩语和巴西葡萄牙语,将支持语言扩展至十二种。此次发布还通过更新训练数据和架构变更,提升了现有语言的质量。
Meta发布了Muse Glimmer,这是一个拥有120K+上下文窗口的30B密集参数模型,专为本地AI智能体工作设计。该模型针对NVIDIA边缘、桌面和工作站平台进行了优化,在单张GPU上可实现20K tokens/sec的推理速度。
NVIDIA发布了NemotronLabs VoiceChat 11B,这是一款面向实时全双工对话的开源11B参数端到端语音转语音模型。与串联ASR、LLM和TTS的级联堆栈不同,该统一网络同时执行流式语音理解和生成,在Full-Duplex-Bench 1.0上测得的平滑切换延迟为448毫秒。