近期
801 →
llama.cpp b10435 修复了 jinja gather_string_parts 中的二次方成本
Claude Code v2.1.233 新增 GitLab MR 支持、内存限制,并在新型号上禁用待办事项工具
xAI 在 GitHub Copilot 中发布 Grok 4.6 编码模型
+798 条
AI agents
246 →
Claude Code v2.1.233 新增 GitLab MR 支持、内存限制,并在新型号上禁用待办事项工具
OpenAI 预览 GPT-5.6 Sol Ultrafast 模式;Google 发布 Gemini 3.7 Flash
Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
+243 条
Inference efficiency
187 →
llama.cpp b10435 修复了 jinja gather_string_parts 中的二次方成本
llama.cpp b10434 将 reasoning_effort 传递给模板
Nvidia 提出 FusionRelight,通过混合领域知识融合实现实时人像重光照
+184 条
API & product launches
113 →
xAI 在 GitHub Copilot 中发布 Grok 4.6 编码模型
OpenAI 预览 GPT-5.6 Sol Ultrafast 模式;Google 发布 Gemini 3.7 Flash
Mistral 以低于 Mistral Medium 3.5 的价格托管 GLM-5.2
+110 条
Code generation
95 →
Claude Code v2.1.233 新增 GitLab MR 支持、内存限制,并在新型号上禁用待办事项工具
xAI 在 GitHub Copilot 中发布 Grok 4.6 编码模型
Meta发布Muse Code智能体框架及低成本Muse Spark 1.2模型
+92 条
Safety & alignment
77 →
Claude 实现 SynthID-Text 水印以满足欧盟《人工智能法案》合规要求
Muse-Ltd 提交 UncertaintyGym 基准用于 LLM 认识论校准
OpenAI代理意外通过Artifactory攻击Hugging Face
+74 条
Research paper
74 →
HorizonRelight 使用掩码自条件实现长时视频重光照的一致性
Faraday 27B 在论文复现任务中超越 Claude Opus 4.8 和 GPT-5.5
Faraday 27B 在论文复现任务上超越 Claude Opus 4.8 和 GPT-5.5
+71 条
Benchmark results
59 →
Z.ai发布GLM-5.3,扩展了后训练过程
Qwen在ModelScope和Hugging Face上发布Qwen3.8-27B模型
Gemini 3.7 Flash 更新让 GDM 重回前沿
+56 条
Local inference
51 →
llama.cpp b10434 将 reasoning_effort 传递给模板
开源模型现状:2026年夏季观察
llama.cpp b10418 增加对 SYCL 主机固定内存的支持
+48 条
Training methods
45 →
ThetaMem提出用于固定状态序列记忆的带符号乘法键提升
Dyna Robotics 发布 Dyna-2:基于百万小时人类视频预训练的世界动作模型
LLM在超参数优化中匹配或优于贝叶斯优化
+42 条
Multimodal
40 →
Intern-S2-Preview:科学智能体基础模型
dots-studio 发布 dots3-note 预览版,一款 280B MoE 模型
Liquid AI 发布 LFM2.5-VL-3B,一款支持工具调用的 3B 端侧视觉语言模型
+37 条
Policy & regulation
37 →
Claude 实现 SynthID-Text 水印以满足欧盟《人工智能法案》合规要求
白宫将扩大人工智能政策,可能增加开源模型
Anthropic、OpenAI、Google、Meta、Microsoft和Mistral签署欧盟AI透明度准则
+34 条
Evaluation & benchmarks
33 →
构建生产级智能体系统的经验教训
Muse-Ltd 提交 UncertaintyGym 基准用于 LLM 认识论校准
ICML 2026 Open Reproductions 挑战赛发现 23% 的已审查论文存在虚假声明
+30 条
Hardware & chips
20 →
阿里巴巴发布适用于 NVIDIA GB300 NVL72 的 Qwen3.8-2.4T-A95B 开源权重
RunSnack 通过单个链接实现 P2P GPU 共享
llama.cpp b10306 添加 SYCL GLU 扁平路径并整合内核
+17 条
Robotics
19 →
Strands Agents 集成 LeRobot 和 Hugging Face Storage Buckets,实现机器人数据的持续循环
Dyna Robotics 发布 Dyna-2:基于百万小时人类视频预训练的世界动作模型
Calibra 检测机器人学习数据集中的问题
+16 条
Retrieval & RAG
16 →
VITA 临床 RAG 在 HealthBench 上匹配或超越前沿大语言模型
针对特定语料的VITA RAG在HealthBench上匹配或超越前沿LLM
VITA临床RAG系统在HealthBench上持平或超越前沿LLM
+13 条
Video generation
15 →
HorizonRelight 使用掩码自条件实现长时视频重光照的一致性
LTX发布LTX-2.5,一款用于本地视频生成的开源权重世界模型
MiniMax发布带有同步音频的开源权重H3视频模型
+12 条
Voice & audio
13 →
llama.cpp b10369 增加 pocket-tts 支持,CUDA 生成速度提升 80%
NVIDIA Magpie TTS 新增阿拉伯语、韩语和葡萄牙语,并提升质量
NVIDIA发布NemotronLabs VoiceChat 11B,一款开源全双工语音转语音模型,切换延迟约450毫秒
+10 条
Image generation
13 →
Nvidia 提出 FusionRelight,通过混合领域知识融合实现实时人像重光照
Google发布DiffusionGemma技术报告
xAI发布Imagine Image 2.0,具备精确编辑与排版能力
+10 条