Grok 4.6在生物安全拒绝方面领先,同时保持常规生物性能
LatchBio在其BioSecBench-Refusal和BioSecBench-Surveillance基准上发布了针对Grok 4.6的独立分析,发现该模型在已测试的前沿系统中,最擅长拒绝伪装的危险任务。
LatchBio在其BioSecBench-Refusal和BioSecBench-Surveillance基准上发布了针对Grok 4.6的独立分析,发现该模型在已测试的前沿系统中,最擅长拒绝伪装的危险任务。
研究人员形式化了推理时拒绝服务(PI-DoS)攻击,这些攻击利用了大型推理模型(LRMs)中显式多步推理的高计算成本。他们提出了 ReasoningBomb,这是一个基于强化学习的框架,训练攻击者生成简短的自然提示,使受害模型陷入病态长且通常不终止的推理轨迹。
NVIDIA发布了Kumo Tabular,这是一个用于表格分类和回归的开源基础模型,通过上下文学习运行,无需训练或特征工程。该模型仅在由结构因果模型生成的人工数据上进行预训练,提供三种规模,参数量从28M到215M不等。
Anthropic 发布了 Claude Sonnet 5.5,这是 Claude 5.5 系列中的第二款模型,将其定位为日常任务、代码修复和文档润色中比 Claude Opus 5.5 更快速且更具成本效益的补充。
Anthropic推出了Claude Opus 5.5,这是其全新Claude 5.5系列中的首款模型,在大多数任务上提供与Claude Fable 5.1相当的性能,同时运行成本比Opus 5低40%。
Anthropic发布了Claude Opus 5.5,这是Claude Opus 5的更低成本继任者,在整体智能基准测试中领先于Artificial Analysis的Intelligence Index v4.3和Vals AI的Vals Index。同时,由OpenAI前员工Diogo Almeida创立的TypeSafe推出了Jev,这是一种通用分类模型,旨在以低于大型语言模型的成本分析文本并返回预定义输出。
OpenAI推出了GPT-6 Sol和Luna,作为GPT-6 Astra更快、更实惠的替代品,将编码、事实准确性、计算机使用和职业任务方面的进步带入低成本模型。
OpenAI 已发布两款新模型 GPT-6 Sol 和 GPT-6 Luna,现已在 OpenAI API 中上线。这两款模型位于此前发布的 GPT-6 Astra 之下,旨在将其技术优势带入更快、更实惠的层级,以应对复杂编码和高容量的日常任务。
Anthropic 发布了 Claude Opus 5.5,这是其全新 Claude 5.5 系列中的首款模型,定位为比前代更高效的选择。该模型旨在以低于 Opus 5 40%的运行成本,在大多数任务中达到与 Claude Fable 5.1 相当的性能水平。
Anthropic 发布了 Claude Opus 5.5,这是其全新 Claude 5.5 系列中的首款模型,在大多数任务上的表现达到 Claude Fable 5.1 的水平,而运行成本比 Opus 5 低 40%。
SpaceXAI 发布了 Grok 4.7,这是一款面向编码、智能体任务和知识工作的全新旗舰模型,与 Grok 4.6 相比,它采用了更大的基座模型并延长了强化学习训练周期。该模型在保持与前代相同定价结构的同时,增强了自我验证、长上下文处理和安全防护能力。
OpenAI 发布了 GPT-6 Astra,这是其全新的旗舰视觉语言模型,在主要 AI 排行榜上取得第一或接近第一的排名,同时使用的 token 数量显著减少,成本低于竞争模型。该模型旨在满足 OpenAI 的关键网络安全级别,高级网络能力仅限选定组织使用。
OpenAI已正式推出GPT-6 Astra,将其定位为迄今为止最智能且对齐度最高的模型。此次发布主要针对计算机使用、软件工程、数学与科学、办公工作以及网络安全。
OpenAI发布了GPT-6 Astra,这是一款面向ChatGPT Plus、Pro、Business和Enterprise用户的新模型,同时通过OpenAI API和AWS提供。该模型的定价为每百万输入token 10美元、每百万输出token 50美元,旨在与Claude Fable 5竞争。
Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1,作为其面向编码和知识工作的新旗舰模型,定位为全球最先进的自主多步任务模型。
Anthropic 发布了 Claude Fable 5.1 和 Claude Mythos 5.1,作为其在编码和知识工作领域的新旗舰模型,定位为能够执行自主多步任务。此次发布包括将缓存读取价格大幅降至每百万 token 0.25 美元,同时支持 100 万 token 的上下文窗口。
Anthropic 发布了 Claude Fable 5.1 和受限版 Claude Mythos 5.1,两者共享底层模型,但在安全层方面有所不同。Fable 5.1 已在各大云提供商处全面开放,而 Mythos 5.1 仍仅限经过审核的组织使用。
来自NVIDIA、麻省理工学院和牛津大学的研究人员推出了Physis-Lang,这是一个通过将自我演化的物理语言整合到字幕中来增强视频世界模型的框架。该方法将物理语言视为一种可优化的表示形式,用于数据筛选、模型训练和推理,以纠正生成视频中的物理错误。
AI Compute Radar发布了一份“厂商板”排名,对贡献于其追踪的46个开源模型的15家实验室进行排名,使用名为Heat Score的综合指标。该排名由每家实验室在前十名的模型数量决定,平局时按最佳名次和30天下载量总和打破。
Anthropic的Frontier Red Team在内部Binary Exploitation基准测试的100项任务上评估了中国模型GLM-5.3,发现其在4%的试验中能够开发完全的控制流劫持。