OpenAI Python SDK v0.21.0 新增与提供商无关的测试 API 和 OpenAI v3 兼容性
OpenAI 发布了 openai-agents-python SDK 的 0.21.0 版本,引入了新的与提供商无关的测试工具,并更新了 OpenAI Python 库版本 3 的兼容性。
OpenAI 发布了 openai-agents-python SDK 的 0.21.0 版本,引入了新的与提供商无关的测试工具,并更新了 OpenAI Python 库版本 3 的兼容性。
xAI 已将其最新的编码模型 Grok 4.6 引入 GitHub Copilot,供使用 VS Code 及其他平台的开发者使用。用户可以通过模型选择器选择新模型,而企业客户可能需要通过 Copilot 设置来启用它。
OpenAI 预览了 Ultrafast,这是一种 GPT-5.6 Sol 模式,能够每秒生成多达 750 个输出标记,并以高达标准处理速度 14 倍的速度运行。该方法旨在提供实时性能,而无需切换到较小的模型。
Mistral 现在托管了 GLM-5.2 模型,其价格甚至比其当前的旗舰模型 Mistral Medium 3.5 还要便宜。
Google推出了Gemini 3.7 Flash,这是一款面向编码和智能体工作流的新款中端模型,提供50%的入门价格折扣,并在基准测试中相比3.6版本取得显著提升。该模型定位为开发主力,已立即集成至Gemini API、Android Studio以及Cline等外部工具链。
Google 已发布 Gemini 3.7 Flash,这是对 3.6 Flash 模型的优化版本,其核心推理基础进行了算法改进,而非采用新的预训练。该模型支持在 1M-token 上下文窗口内处理文本、图像、音频和视频,并提供可定制的思考配置,以平衡质量与成本及延迟。
Google 推出了 Sheets Canvas,这是一个由 Gemini 驱动的新功能,可通过自然语言提示将 Google Sheets 电子表格转化为自定义的交互式微型应用。
Google发布了Gemini 3.7 Flash,这是一款旨在增强编码、智能体工作流和知识工作能力的更新模型。该版本在上一版发布三周后推出,结合了开发者反馈与算法创新。
OpenAI推出了GPT-5.6模型系列,旨在通过优化推理开销并引入新的API控制功能,以更低的成本实现前沿级别的智能体性能。此次更新允许初创公司使用Luna和Terra等较小规模的模型处理高吞吐量任务,同时保留较大模型用于复杂判断,从而构建速度更快、能力更强的智能体。
OpenAI 正在推出 Ultrafast 的预览版,这是一个新的服务层级,其运行 GPT-5.6 Sol 模型的速度比标准处理快多达 14 倍。该模式由 Cerebras 硬件提供支持,每秒可生成多达 750 个输出标记,最初通过 OpenAI API 提供。
DeepSeek-V4-Pro 的通用可用性已在 APP、Web 和 API 平台上推出。此次更新显著提升了生产环境中代理的性能,同时引入了对 OpenAI Responses API 格式的本地支持。
DeepSeek宣布推出其新模型DeepSeek-V4-Pro。
DeepSeek-V4-Pro-0813 的非预览版本已列在 DeepSeek 官方定价页面上。此次发布没有附带推文、新闻公告或 Hugging Face 权重。
SpaceXAI发布了Grok 4.6,这是对Grok 4.5的后期训练升级版本,具备50万token的上下文窗口,并增强了长程代理、编码和知识工作的能力。
本周AI新闻重点介绍了xAI、阿里巴巴和DeepSeek的重大发布,以及开源视频模型和推理基础设施的更新。
DeepSeek 已通过 OpenRouter 平台将其最新的 V4 Pro 模型(版本 0813)通过 API 提供。来源备注指出,虽然官方公告页面并不明显,但之前版本如 DeepSeek-V4-Pro 和 DeepSeek-V4-Flash-0731 的权重已在 Hugging Face 上公开。
OlmoEarth Studio 现在允许用户从其开源的 OlmoEarth 基础模型中计算并导出嵌入向量,以供下游任务使用。这些紧凑的数值表示以轻量级的云优化 GeoTIFF(COG)格式提供,可使用标准地理空间工具进行共享和分析。
Google DeepMind 与 Android 团队推出了 SL2T,这是一款超大规模多语言的手语转文本(SL2T)翻译模型,首次将手语人工智能引入消费级产品。该技术为 Pixel 11 上的 Gboard 和实时转录应用中的手语转文本听写功能提供支持,初期支持美国手语(ASL)到英语的转换。
两项新的OpenAI研究显示,前沿公司——即每月AI使用量排名前10%的公司——每位活跃用户生成的输出token数量是普通公司的8.3倍,而今年1月这一比例为2.6倍。这种不断扩大的差距反映了企业采用AI的方式从辅助转向将实质性工作委托给Codex和ChatGPT Work等智能体工具。
CrewAI 发布了 1.15.15 版本,引入了用于监控工作流执行的新功能,同时包含多项依赖更新和错误修复。