DeepSeek 已在 Hugging Face 上发布了 DeepSeek-V4-Flash-Vision-Exp 模型检查点。 该仓库现已公开可用。
media
r/LocalLLaMA
·
6 小时前
·
open_models
DeepSeek 在 Hugging Face 上发布 DeepSeek-V4-Flash-Vision-Exp
译自 English → 中文
相关文章
media
Interconnects
·
29 天前
·
19 次浏览
Thinking Machines发布Inkling,腾讯以Apache 2.0许可证更新Hy3
最新的开源模型成果汇总突出了Thinking Machines和腾讯的重大发布,以及Poolside和DeepSeek的更新。
media
AI News (smol.ai)
·
45 天前
·
14 次浏览
Thinking Machines Lab 发布开源权重的 Inkling 基础模型
Thinking Machines Lab 推出了 Inkling,这是其首个完全发布的开源权重基础模型系列。Inkling 定位为可定制的 multimodal 基础模型,而非以基准测试为最高目标的旗舰产品,支持文本、图像和音频输入,具备原生多模态能力。
media
MarkTechPost
·
5 天前
·
20 次浏览
阿里巴巴Qwen团队发布Qwen3.8-Flash-Next,预览Qwen4架构
阿里巴巴Qwen团队发布了Qwen3.8-Flash-Next,这是一个开源权重的多模态混合专家模型,旨在预览即将推出的Qwen4系列架构。该检查点将125B主干与51B N-gram嵌入表和4B多令牌预测模块配对,每个令牌仅激活6B参数。
media
r/LocalLLaMA
·
5 天前
·
30 次浏览
智谱AI发布GLM-5.3-Flash多模态开源权重模型
智谱AI发布了GLM-5.3-Flash,这是GLM-5系列中首个原生多模态模型,也是glm5_next架构的首个开源权重版本。该模型拥有320B参数,在包含30T token的多模态语料库上训练,并采用混合稀疏和线性注意力机制以降低长上下文推理成本。
lab
Zhipu / Z.ai (GLM, HF)
·
5 天前
·
23 次浏览
智谱发布 GLM-5.3-Flash,一款拥有 320B 参数的多模态模型
智谱推出 GLM-5.3-Flash,这是 GLM-5 系列中首个原生多模态模型,采用混合架构,结合稀疏注意力和线性注意力,在保持精度的同时降低长上下文服务成本。