OpenAI 预览 GPT-5.6 Sol Ultrafast 模式;Google 发布 Gemini 3.7 Flash
OpenAI 预览了 Ultrafast,这是一种 GPT-5.6 Sol 模式,能够每秒生成多达 750 个输出标记,并以高达标准处理速度 14 倍的速度运行。该方法旨在提供实时性能,而无需切换到较小的模型。
OpenAI 预览了 Ultrafast,这是一种 GPT-5.6 Sol 模式,能够每秒生成多达 750 个输出标记,并以高达标准处理速度 14 倍的速度运行。该方法旨在提供实时性能,而无需切换到较小的模型。
Google 已开源其 WeatherNext 2 和 WeatherNext Cyclones AI 模型,以提高气旋预报的准确性。这些模型在预测路径、强度和风场结构方面取得了 state-of-the-art 的结果,与当前方法相比,为预报员提供了平均多一天的预测精度。
OpenAI分享了在评估一款未发布模型时发现的十项成果,解决了或在对数学和理论计算机科学中长期存在的开放性问题上取得了实质性进展。同时,拥有2.4万亿参数的Qwen 3.8-Max模型现已可用,在编程、工作、研究和长程任务方面均带来改进。
Anthropic推出了Claude Opus 5,这是一款效率更高的模型,其能力接近Claude Fable 5,但价格减半,成为Claude Max的默认模型。与此同时,NVIDIA正在倡导美国政府政策支持开放权重的AI模型,以促进创新并增强美国在该领域的领导地位。
Google 发布了三款新模型:用于高效通用代理工作负载的 Gemini 3.6 Flash、用于低延迟应用的 3.5 Flash-Lite,以及与 CodeMender 集成的网络安全专用 3.5 Flash 模型。
Anthropic 已升级 Claude Chrome 扩展程序,使其侧边栏现在可运行完整的 Claude Cowork 会话。此更新允许对话直接保存到用户的 Claude 账户,并在桌面、网页或移动设备之间无缝恢复。
本期TLDR AI涵盖三项重大进展:Anthropic的Claude模型显著提升了满足黎曼猜想零点的下界,Meta发布了开源权重的Muse Glimmer模型,OpenAI推出了一款专用的网络安全模型。
Meta发布了Muse Code,这是一个由Muse Spark 1.2驱动的终端编码代理,旨在处理复杂的仓库级工程任务。与此同时,Google DeepMind宣布重大领导层变动,Demis Hassabis将担任Google DeepMind主席兼Alphabet首席科学家,而Jeff Dean在任职27年后离职。
由前OpenAI高管Fidji Simo创立的ChronicleBio正利用AI和153 TB的血液数据来治愈体位性心动过速综合征(POTS)。与此同时,Mind Lab的Macaron-V1模型通过在五个LoRA专家模块之间动态切换以实现持续学习,在基准测试中超越了GLM-5.2。
Thinking Machines发布了Inkling-Small,这是一个拥有276B参数(其中12B为活跃参数)的mixture-of-experts模型,在保持多模态推理能力和1M token上下文窗口的同时,使用了更少的计算资源。
xAI 已为 SuperGrok Heavy 订阅用户推出“Build Mode”,使用户能够直接从聊天中生成、编辑、预览和发布网站、应用、游戏和仪表板,无需进行任何设置。与此同时,来自前沿 AI 公司的一千多名员工签署了一份声明,要求美国政府支持一项国际努力,以开发工具来有意控制自动化 AI 发展的前沿速度。
Moonshot 发布了 Kimi K3 的模型权重和技术报告。Kimi K3 是一个拥有原生视觉理解和 100 万 token 上下文窗口的 2.8T Mixture-of-Experts 模型。此次发布包括高性能注意力内核、MoE 通信库以及用于大规模运行智能体环境的基础设施。
AMD和Anthropic签署了一项涉及数百亿美元AI服务器的重大协议,Anthropic将从明年上半年开始购买多达2吉瓦的AMD Instinct MI450芯片。同时,随着特定部署里程碑的达成,AMD将向Anthropic投资高达50亿美元,两家公司还将合作确定适合该硬件的数据中心。
本TLDR AI通讯涵盖了人工智能行业的几项发展,包括新硬件、软件代理和路由优化。
阿里巴巴宣布开源 Qwen3.8,这是一个拥有 2.4 万亿参数的模型,同时开源了其“玄武”AI 芯片软件技术栈,以减少对英伟达 CUDA 生态系统的依赖。
Moonshot发布了Kimi K3,这是一个拥有2.8万亿参数和100万token上下文窗口的大多模态模型,而Schema harness使前沿模型在ARC-AGI-3基准测试中达到了99%的准确率。
Thinking Machines 发布了 Inkling,这是一个拥有 975B 参数、41B 激活参数的混合专家模型,具备多模态推理能力。与此同时,Anthropic 在完成了估值达 9650 亿美元的 650 亿美元融资轮后,正在为今年晚些时候的潜在首次公开募股(IPO)做准备。OpenAI 还训练了 GPT-Red 以迭代生成对抗性提示,使 GPT-5.6 Sol 在提示注入基准测试中的失败率降低了六倍。