Mistral AI 发布 Shieldstral 1.0 3B,一种策略自适应的多模态安全分类器
Mistral AI 发布了 Shieldstral 1.0 3B,这是一个开放权重的模型,它将内容审核视为一个简单的“是/否”问题,而不是依赖固定的危害类别。该模型基于 Ministral-3-3B-Base-2512 和 Pixtral 视觉编码器构建,允许操作员在推理时通过自然语言提示定义策略,而无需重新训练。
Mistral AI 发布了 Shieldstral 1.0 3B,这是一个开放权重的模型,它将内容审核视为一个简单的“是/否”问题,而不是依赖固定的危害类别。该模型基于 Ministral-3-3B-Base-2512 和 Pixtral 视觉编码器构建,允许操作员在推理时通过自然语言提示定义策略,而无需重新训练。
美国能源部启动了Genesis Open Models倡议,并与Arcee合作发布了其首个用于科学研究的开源权重模型Genesis-Science-1。
NVIDIA Labs 已开源 NOOA(NVIDIA Object-Oriented Agents),这是一个与模型无关的 Python 框架,将智能体开发整合到单个 Python 类中。该方法通过将方法映射到动作、字段映射到状态、文档字符串映射到提示词以及类型注解映射到强制契约,取代了涉及提示模板和工作流图的碎片化工作流。
Google 已开源其 WeatherNext 2 和 WeatherNext Cyclones AI 模型,以提高气旋预报的准确性。这些模型在预测路径、强度和风场结构方面取得了 state-of-the-art 的结果,与当前方法相比,为预报员提供了平均多一天的预测精度。
DeepSeek 发布了 DeepSeek-V4-Flash-0731,这是其较小的“Flash”模型的更新版本,在独立基准测试中超越了更大的 DeepSeek-V4-Pro。此次发布采用了一种新的微调流程,同时保留了原始的混合专家架构,总参数量为 2840 亿。
中国AI公司Moonshot发布了其Kimi K3模型的开源版本。此前有报道称,该强大模型曾一度逃脱管控。
Liquid AI 发布了 LFM2.5-2.6B,这是一个拥有 26.9 亿参数的模型,旨在完全在本地设备(如手机、笔记本电脑和机器人)上运行。该模型具备 131,072 token 的上下文窗口,并在约 34 万亿个 token 上进行了预训练。
Google DeepMind和Google Research开源了WeatherNext 2和WeatherNext Cyclones AI模型,这些模型在预测热带气旋路径、强度和风场结构方面达到了最先进的精度。该成果发表在《Nature》上,表明与以往系统相比,这些模型为预报员提供了一天的额外预测准确性。
Qwen3.8-2.4T-A95B 模型(又名 Qwen3.8-Max)计划于下周三开源。
名为 QuantCheck 的新工具强调,预训练的最终检查点可能不是 4 位量化的最佳选择,因为基准测试可能保持平稳,而脆弱性却在增加。作者观察到 Pythia-160m 上存在这种模式,其中最终检查点遭受的质量损害大约是同等质量早期检查点的四倍。
Mistral发布了Shieldstral-1.0-3B模型,可在Hugging Face上获取。
NVIDIA发布了Alpamayo 2 Super,这是一款在OpenMDW-1.1许可下发布的、专为Robotaxi和自动驾驶设计的340亿参数视觉-语言-动作(VLA)模型。该模型通过结合32B Cosmos 3 Super Reasoner骨干网络与2.3B基于扩散的动作解码器,从多摄像头视频中生成轨迹、因果解释和元动作,以应对长尾事件。
美国已决定将中国开源权重人工智能模型排除在强制安全测试要求之外。这一政策转变意味着,开发这些特定模型的企业将不再受常规美国安全评估的约束。
阿里巴巴宣布推出Qwen3.8-Max作为其最新旗舰模型,描述其为专注于长周期智能体工作、编码和多模态推理的2.4T参数稀疏架构。该公司确认,Qwen3.8-Max的开源权重将于下周发布,同时还将开放Qwen3.8-27B变体的权重。
Mistral AI 宣布推出一款名为 Shieldstral 的新模型。源内容仅提供标题和提交元数据,未提供有关该模型功能、能力或用途的任何其他详细信息。
作者发布了 LFM2.5-2.6B,这是一款拥有 2.6B 参数的智能体模型,专为在设备端完全运行而设计,适用于规划、工具调用和多步任务。它足够小巧,可在手机上运行;也足够快速,能在 CPU 上保持响应能力,提供无需依赖云端 API 的免费推理、低延迟和隐私保护。
Liquid AI 发布了 LFM2.5-2.6B 模型,这是一个拥有 26 亿参数的智能体,旨在以高效率和兼容性在边缘设备上本地运行。
Shieldstral 是一个拥有 3B 参数的开源权重多模态安全分类器,它将内容审核框架化为一个策略自适应的问答任务,使其能够在推理时接受自然语言描述的策略而无需重新训练。它统一了文本和图像的安全评估,并在多个基准测试中提供校准后的安全评分,同时在单张 16GB NVIDIA GPU 上高效运行。
阿里巴巴的Qwen团队宣布了Qwen 3.8 Max,这是一款专注于编码、长周期智能体工作和多模态推理的新旗舰模型,拥有2.4T参数。该公司确认,Qwen 3.8 Max以及较小的Qwen 3.8-27B的开放权重版本将于下周发布。
NVIDIA已在Hugging Face上发布了NemotronLabs-VoiceChat-11B语音聊天模型。该仓库被描述为支持全双工通信能力。