阿里巴巴发布适用于 NVIDIA GB300 NVL72 的 Qwen3.8-2.4T-A95B 开源权重
阿里巴巴发布了其最大开源模型 Qwen3.8-2.4T-A95B(也称为 Qwen3.8-Max)的开源权重,旨在为开放生态带来接近前沿的能力。
阿里巴巴发布了其最大开源模型 Qwen3.8-2.4T-A95B(也称为 Qwen3.8-Max)的开源权重,旨在为开放生态带来接近前沿的能力。
Meta发布了Muse Glimmer,这是一个拥有120K+上下文窗口的30B密集参数模型,专为本地AI智能体工作设计。该模型针对NVIDIA边缘、桌面和工作站平台进行了优化,在单张GPU上可实现20K tokens/sec的推理速度。
NVIDIA 发布了 Nemotron 3 Ultra 模型,该模型在代理式寄存器传输级 (RTL) 编码任务的准确性和效率方面均领先于其他开源模型。
NVIDIA 概述了如何通过与其 BlueField 处理器进行极致的协同设计来解决 Agentic AI 工作负载带来的基础设施挑战。该公司认为,随着智能体系统触发复杂的模型调用链、工具交互和数据查找,传统的基础设施模式已不足以维持性能。
能够感知、推理并对海量视频素材采取行动的视频分析 AI 代理必须与现有工作流程集成才能发挥作用。这些工作流程包括内容管理系统、消息传递平台、数据库、工单队列和升级路径。