Claude Code v2.1.233 新增 GitLab MR 支持、内存限制,并在新型号上禁用待办事项工具
Anthropic 发布了 Claude Code v2.1.233,引入了多项新功能和修复,包括为 `--worktree` 标志和 `claude agents` 视图添加 GitLab 合并请求 URL 支持。该更新还增加了 Linux 上 Bash 工具命令的可选内存 cgroup 支持,以防止失控构建导致会话卡住。
Anthropic 发布了 Claude Code v2.1.233,引入了多项新功能和修复,包括为 `--worktree` 标志和 `claude agents` 视图添加 GitLab 合并请求 URL 支持。该更新还增加了 Linux 上 Bash 工具命令的可选内存 cgroup 支持,以防止失控构建导致会话卡住。
xAI 已将其最新的编码模型 Grok 4.6 引入 GitHub Copilot,供使用 VS Code 及其他平台的开发者使用。用户可以通过模型选择器选择新模型,而企业客户可能需要通过 Copilot 设置来启用它。
Z.ai宣布推出GLM-5.3,这是一款通过在基础模型GLM-5.2上扩展后训练阶段,在智能体编程基准测试中取得前沿性能的新模型。该~750B参数模型目前在各种基准测试中超越了Kimi K3,并持平或超越了Claude Fable 5和GPT-5.6-Sol。
llama.cpp 项目发布了构建版本 b10434,增加了对将 `reasoning_effort` 参数传递到 Jinja 模板的支持。此更改确保 OpenAI Chat Completions 的 `reasoning_effort` 值在生成期间被存储并可访问。
Anthropic 将在未来的 Claude 模型中实施文本水印,以符合欧盟《人工智能法案》及其关于 AI 生成内容透明度的行为准则。该公司采用 Google DeepMind 发布的 SynthID-Text 方法,该方法在不影响输出质量或增加额外 token 的情况下,在生成的文本中嵌入可检测的模式。
研究人员通过将任务重新定义为时间条件的潜在域转换,解决了长时视频重光照中的时间不连续性问题。该框架通过跨边界传播目标域潜在变量来强制分块间的连续性,并利用掩码目标域自条件使这种行为可学习。
来自 Nvidia 的研究人员推出了 FusionRelight,这是一种用于人像重光照的方法,它将物理上合理的照明转移与身份保持以及紧凑的实时推理相结合。该方法利用混合领域知识融合(HDKF)训练框架,将合成数据、一次一盏光(OLAT)数据和真实场景数据中的物理、反射率和真实性先验蒸馏到一个学生模型中。
llama.cpp 项目发布了版本 b10431,在 ggml_ssm_scan 操作中引入了对循环状态 (RS) 回滚的支持。此更改使 Nemotron 模型能够在 CPU 和 CUDA 后端上实现 RS 回滚。
OpenAI 预览了 Ultrafast,这是一种 GPT-5.6 Sol 模式,能够每秒生成多达 750 个输出标记,并以高达标准处理速度 14 倍的速度运行。该方法旨在提供实时性能,而无需切换到较小的模型。
用户 helloadhavan 创建了一个名为 CC-FilteredCorpus 的数据集,旨在过滤 Common Crawl 并提取干净的 Markdown 内容。该项目旨在保留有用的文档结构,包括标题、列表、链接、代码块和表格,而不是将所有内容扁平化为纯文本。
Meta推出了Muse Code,这是一个由新型Muse Spark 1.2模型驱动的命令行智能体编码框架。此次发布包含一个“贡献者层级”,大幅降低了允许Meta使用其交互数据进行训练的开发者成本。
一份分析2026年初Hugging Face Hub数据的报告揭示,中国实验室在前沿开源模型规模上已超越美国实验室,而NVIDIA和AMD等硬件供应商则主导了新仓库的发布。该分析强调了社区热情(点赞数)与实际采用量(下载量)之间的分歧,小型模型仍是本地推理的实际标准。
Qwen已发布其Qwen 3.8 27B模型的开源权重。 该检查点可在Hugging Face上获取。
Qwen已发布Qwen3.8-27B模型,可在ModelScope和Hugging Face上下载。
过去一个月内,中国发布了四个大型语言模型:Kimi K3-2.8T、Qwen3.8-2.4T、DeepSeek-V4-Pro-0813-1.6T 和 GLM-5.3-743B。
llama.cpp 项目发布了版本 b10429,该版本修改了服务器,使其在 llama_decode() 执行期间允许访问 /metrics 和 /slots 端点。
llama.cpp 项目发布了版本 b10430,引入了对虚拟集成 GPU (igpu) 设备的支持。此更新还包括代码库中改进的注释。
Z.ai 发布了 GLM-5.3,这是对其 743B 参数模型的更新,该模型通过扩展后训练而非基础模型重新训练来实现性能提升。目前可通过 Z.ai API、GLM Coding Plan 和 ZCode 获取该版本,公共权重将在发布后约两周经过安全评估后推出。
一位工程师详细阐述了在将项目从简单的聊天机器人过渡到具备规划、工具使用和多步任务完成能力的健壮智能体系统时,所遇到的架构和故障模式。
Qwen 3.8 Max 的正式发布证实了早期印象,即该模型速度极快,在规划方面能力出众,并擅长识别问题中的不必要复杂性。