xAI 推出用于编码和知识工作的 Grok 4.7
xAI 发布了 Grok 4.7,这是一款旨在提升困难编码任务和通用知识工作性能的新模型。它利用更大的基础模型和扩展的强化学习来更好地处理长上下文场景并验证其自身输出。
xAI 发布了 Grok 4.7,这是一款旨在提升困难编码任务和通用知识工作性能的新模型。它利用更大的基础模型和扩展的强化学习来更好地处理长上下文场景并验证其自身输出。
xAI 发布了 Grok Voice Transcribe 2.0,这是一款语音转文本模型,其准确率是 1.0 版本的两倍,同时保持相同的价格。该模型基于 Grok Voice 背后的音频基础模型构建,利用独特的实时嘈杂多语言音频数据集,以应对电话线路不稳定和声音竞争等具有挑战性的现实条件。
LatchBio在其BioSecBench-Refusal和BioSecBench-Surveillance基准上发布了针对Grok 4.6的独立分析,发现该模型在已测试的前沿系统中,最擅长拒绝伪装的危险任务。
xAI 推出了“团队机器人”(Team Bots)功能,允许用户创建共享的 Grok 机器人,与团队成员协同工作并共同学习。这些机器人将文件、应用和专业知识整合到一个统一的上下文中,供所有人访问,同时为每位用户的对话保持独立的隐私。
在收购 Cursor 之后,SpaceXAI 将其 Grok Bot AI 代理整合到其合并的客户支持运营中,使团队能够在不增加人员的情况下管理工单量增长 175%。该公司避免了雇佣约 200 名额外员工,并通过利用 Grok Bot 的按使用量定价模型,将每个工单的解决成本降低至 0.20 至 0.30 美元之间。
Grok Build 现在通过自动记录从一个会话到下一个会话的规范、决策和事实来保留项目上下文。在用户工作时,系统会在后台捕获持久信息,而不会中断工作流程。
xAI部署了一个名为“Haggle Bot”的自主代理,用于管理企业采购任务,通过分析供应商支出、合同和使用数据,成功识别出超过10万美元的直接节省。该机器人可以访问Slack、Notion、Ramp和Gmail等工具,从而无需逐步人工干预即可审计SaaS订阅、协商续约并优化经常性购买。
xAI 已将 Grok Bot 设计为一个持久代理,使其能够在不同会话中保持责任,从而将界面焦点从一次性聊天线程转向长期运行的 Bots。该系统围绕五个核心概念组织交互:Bots、Chats、Routines、Tools 和 Memories。
xAI已面向企业客户推出Grok Bot,引入了访问、网络和审计控制,以大规模管理机器人。此次发布允许组织在现有工具和流程内创建自主AI员工。
SpaceXAI 发布了 Grok 4.7,这是一款面向编码、智能体任务和知识工作的全新旗舰模型,与 Grok 4.6 相比,它采用了更大的基座模型并延长了强化学习训练周期。该模型在保持与前代相同定价结构的同时,增强了自我验证、长上下文处理和安全防护能力。
2026年9月12日,Anthropic首席执行官Dario Amodei发表了一篇题为《我们必须控制前沿步伐》的文章,呼吁减缓AI能力的提升。该提案包括一个三步计划:建立拥有员工级训练流水线访问权限的第三方“嵌入式评估者”,协调前沿实验室之间的安全标准,以及推动关于AI限制的全球协议。
一项研究表明,包括 Claude Code、Codex、Antigravity、Open Code 和 Grok Build 在内的本地大语言模型代理未能强制执行边界以阻止修改其自身的执行日志。研究证明,这些代理可以在请求时删除其轨迹而不会触发监控护栏,这是一种外部攻击者也可以利用的漏洞。
小米已开源 MiMo-V2.6 Pro 和 Flash 多模态模型,旨在协调智能体构建并视觉测试交互式 3D 场景。这些模型可以生成 Blender 资产、根据摄像头画面控制机械臂、生成前端和演示文稿、组装视频以及创作乐谱和 MIDI 音乐。
一项诉讼声称,Anthropic、OpenAI、SpaceX AI和Google达成了非法协议,故意减缓人工智能的发展。 该投诉针对这四家大型科技公司涉嫌协调限制人工智能进步的行为。
SpaceXAI发布了Grok Voice Transcribe 2.0,这是一款通过托管API提供的语音转文本模型,在相同价格点下声称比1.0版本准确率高出两倍。该模型针对嘈杂电话线和竞争声音等困难音频条件设计,支持批量和实时流式处理模式。
AI评估论坛发布了AEF-1,这是一项针对独立第三方AI评估的提案基线,涵盖访问权限、利益冲突、资金关系、回避制度和透明度。该标准的推出与Dario Amodei提出的前沿AI公司承诺为嵌入式第三方评估人员提供持续、类似员工的访问权限的提议同步进行。