Nvidia 使用其新型工具 AVO 在 ARC AGI-3 基准测试中取得了 100% 的完美成绩。文章指出,OpenAI 在相同基准测试的结果中并未使用这一标准工具。
- Nvidia 使用 AVO 工具在 ARC AGI-3 上取得 100% 的成绩。
- OpenAI 在其 ARC AGI-3 评估中使用了不同的非标准工具。
Nvidia 使用其新型工具 AVO 在 ARC AGI-3 基准测试中取得了 100% 的完美成绩。文章指出,OpenAI 在相同基准测试的结果中并未使用这一标准工具。
| Benchmark | 模型 | 得分 |
|---|---|---|
| ARC-AGI 3 | Nvidia AVO | 100% |
NVIDIA发布了其AVO架构,该架构在ARC-AGI-3基准测试中取得了完美分数。该系统旨在通过管理上下文、工具使用和状态恢复来支持长周期自主智能体。
OpenAI 推出了 GPT-5.6,引入了 Luna、Terra 和 Sol 的新模型阶梯,以及 Max 和 Ultra 模式的独特努力级别。此次发布对 ChatGPT Work 和 Codex 界面带来了重大变化,但最初因导航混乱和使用量快速耗尽而遭到用户抵制。
OpenAI发布了GPT-5.5,这是自GPT-4.5以来首个完全重新训练的基座模型,采用统一架构处理文本、图像、音频和视频。该模型与NVIDIA的GB200和GB300 NVL72系统联合设计,以在能力增强的同时保持低延迟。
OpenAI已正式推出GPT-6 Astra,将其定位为迄今为止最智能且对齐度最高的模型。此次发布主要针对计算机使用、软件工程、数学与科学、办公工作以及网络安全。
OpenAI发布了GPT-6 Astra,这是一款封闭的托管模型,主要定位为计算机使用系统而非聊天模型。它可在浏览器、电子表格和终端中操作软件以完成多步骤任务,具备1,050,000个token的上下文窗口以及截至2026年4月30日的知识截止期。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策