GLM 5.3 发布
GLM团队发布了GLM模型的5.3版本。
GLM团队发布了GLM模型的5.3版本。
DeepSeek宣布推出其新模型DeepSeek-V4-Pro。
Meta 发布了 Muse Glimmer,这是一款拥有 300 亿参数的密集多模态模型,专为始终在线的本地智能体工作流而优化。该模型的权重在 Apache 2.0 许可证下开放。
DeepSeek 已更新其 V4 Flash 模型,于 2026-07-31 发布新版本,相比之前的预览版性能显著提升。此次更新引入了多个新基准测试的结果,并提升了现有基准的得分。
DeepSeek-V4-Flash 的官方版本现已在 DeepSeek API 上线。
Moonshot AI 发布了其 Kimi K3 模型的权重。该检查点现已在 Hugging Face 上提供。
Moonshot AI 发布了 Kimi K3 2.8T 模型,该模型现已在 Hugging Face 上提供。
Moonshot AI 发布了 Kimi K3 模型,该模型现已在 Hugging Face 上提供。
Moonshot AI已在Hugging Face上发布了Kimi K3的倒计时。该模型现在可以通过源材料中提供的直接链接访问。
Kimi K3现已通过网页界面和移动应用程序发布使用。该模型拥有2.8万亿参数,并支持100万token的上下文窗口。
Qwen已发布其Qwen 3.8 27B模型的开源权重。 该检查点可在Hugging Face上获取。
Qwen已发布Qwen3.8-27B模型,可在ModelScope和Hugging Face上下载。
过去一个月内,中国发布了四个大型语言模型:Kimi K3-2.8T、Qwen3.8-2.4T、DeepSeek-V4-Pro-0813-1.6T 和 GLM-5.3-743B。
Qwen 3.8 Max 的正式发布证实了早期印象,即该模型速度极快,在规划方面能力出众,并擅长识别问题中的不必要复杂性。
一位 Reddit 用户强调了 DeepSeek DSv4 Flash 0731 模型,指出其相对于成本的强大性能。该帖子引用了 Artificial Analysis Intelligence Index v4.1.1 来支持该模型表现出色的说法。
Mistral 现在托管了 GLM-5.2 模型,其价格甚至比其当前的旗舰模型 Mistral Medium 3.5 还要便宜。
dots-studio 发布了其 dots3 系列中的首个开源权重模型,名为 dots3-note preview。该 Mixture-of-Experts 模型拥有 280B 总参数,其中激活了 16B,并支持高达 512K token 的上下文。
DeepSeek-V4-Pro-0813 模型检查点已在 Hugging Face 平台上重新提供。
DeepSeek AI 发布了 DeepSeek Harness(dsh),这是一个目前处于开发者预览阶段的开源智能体框架。该工具利用由 Cordis 驱动的插件架构,旨在实现时空组合性。
DeepSeek 已推出 DeepSeek Harness v0.1 的开发者预览版,并在 MIT 许可证下开源代码库,供构建智能体工具链的开发者使用。