xAI 在 GitHub Copilot 中发布 Grok 4.6 编码模型
xAI 已将其最新的编码模型 Grok 4.6 引入 GitHub Copilot,供使用 VS Code 及其他平台的开发者使用。用户可以通过模型选择器选择新模型,而企业客户可能需要通过 Copilot 设置来启用它。
xAI 已将其最新的编码模型 Grok 4.6 引入 GitHub Copilot,供使用 VS Code 及其他平台的开发者使用。用户可以通过模型选择器选择新模型,而企业客户可能需要通过 Copilot 设置来启用它。
Google发布了Gemini 3.7 Flash,这是一款旨在增强编码、智能体工作流和知识工作能力的更新模型。该版本在上一版发布三周后推出,结合了开发者反馈与算法创新。
OpenAI推出了GPT-5.6模型系列,旨在通过优化推理开销并引入新的API控制功能,以更低的成本实现前沿级别的智能体性能。此次更新允许初创公司使用Luna和Terra等较小规模的模型处理高吞吐量任务,同时保留较大模型用于复杂判断,从而构建速度更快、能力更强的智能体。
DeepSeek-V4-Pro 的通用可用性已在 APP、Web 和 API 平台上推出。此次更新显著提升了生产环境中代理的性能,同时引入了对 OpenAI Responses API 格式的本地支持。
xAI发布了Grok 4.6,这是对其模型的更新,专注于长运行智能体和复杂的交互式工作。新版本在Artificial Analysis Intelligence Index上与GPT-5.6 Sol持平,并可在Cursor、Grok Build以及通过API使用。
xAI已将Imagine Image 2.0作为新的质量模式以及iOS和Android应用全面开放。此次更新专注于为专业创意工作流提供精确的图像生成与编辑功能。
OpenAI 正在推出 Ultrafast 的预览版,这是一个新的服务层级,其运行 GPT-5.6 Sol 模型的速度比标准处理快多达 14 倍。该模式由 Cerebras 硬件提供支持,每秒可生成多达 750 个输出标记,最初通过 OpenAI API 提供。
Google DeepMind 与 Android 团队推出了 SL2T,这是一款超大规模多语言的手语转文本(SL2T)翻译模型,首次将手语人工智能引入消费级产品。该技术为 Pixel 11 上的 Gboard 和实时转录应用中的手语转文本听写功能提供支持,初期支持美国手语(ASL)到英语的转换。
OpenAI 和 AWS 已通过 Amazon Bedrock 提供 Daybreak 功能,使符合条件的客户能够在其现有的 AWS 环境中访问前沿网络模型。此集成为企业使用熟悉的安全、治理和运营工作流应用先进 AI 提供了路径。
Google Research 和 Google DeepMind 推进了其医疗 AI 研究系统 AMIE,在一项首创研究中展示了实时临床视频问诊能力。该系统基于 Gemini 和 Project Astra,采用多智能体架构,能够解释视觉和听觉线索,指导虚拟体格检查,并进行实时诊断推理。
xAI 已以测试版形式推出 Grok Bot,引入了一套常驻 AI 智能体系统,这些智能体在各自的云端计算机上运行,端到端处理任务。今天起,SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium 订阅用户可在桌面端和 iOS 上使用,这些智能体跨应用和工具工作,无需手动配置工作流程。
OpenAI 正在通过新增的两个访问层级——Daybreak Blue 和 Daybreak Red——来扩展其 OpenAI Daybreak 计划,旨在为经批准的防御者提供使用新推出的 GPT-5.6-Cyber 模型的高级网络安全能力。
Anthropic 将在未来的 Claude 模型中实施文本水印,以符合欧盟《人工智能法案》及其关于 AI 生成内容透明度的行为准则。该公司采用 Google DeepMind 发布的 SynthID-Text 方法,该方法在不影响输出质量或增加额外 token 的情况下,在生成的文本中嵌入可检测的模式。
研究人员通过将任务重新定义为时间条件的潜在域转换,解决了长时视频重光照中的时间不连续性问题。该框架通过跨边界传播目标域潜在变量来强制分块间的连续性,并利用掩码目标域自条件使这种行为可学习。
来自 Nvidia 的研究人员推出了 FusionRelight,这是一种用于人像重光照的方法,它将物理上合理的照明转移与身份保持以及紧凑的实时推理相结合。该方法利用混合领域知识融合(HDKF)训练框架,将合成数据、一次一盏光(OLAT)数据和真实场景数据中的物理、反射率和真实性先验蒸馏到一个学生模型中。
Google 推出了 Sheets Canvas,这是一个由 Gemini 驱动的新功能,可通过自然语言提示将 Google Sheets 电子表格转化为自定义的交互式微型应用。
微软研究院推出了MindTopo,这是一个旨在评估多模态大语言模型是否具备关于连通性、包围性、顺序性、分离性和结拓扑直觉的新基准。
两项新的OpenAI研究显示,前沿公司——即每月AI使用量排名前10%的公司——每位活跃用户生成的输出token数量是普通公司的8.3倍,而今年1月这一比例为2.6倍。这种不断扩大的差距反映了企业采用AI的方式从辅助转向将实质性工作委托给Codex和ChatGPT Work等智能体工具。
一篇新论文探讨了使用基础大型语言模型(LLM)来自动化超参数优化(HPO),这一过程通常在有限预算设置下依赖手动方法。作者开发了一种方法论,其中LLM根据数据集和模型的描述建议超参数配置,然后根据模型性能进行迭代优化。
研究人员推出了Source,这是一种新的训练数据归因(TDA)方法,结合了影响函数的计算效率和基于展开方法的准确性。通过使用类似影响函数的公式来近似展开微分,Source解决了隐式微分方法的局限性,例如它们未能考虑优化偏差或多阶段流水线。