腾讯发布了其 Hy4-preview 模型的权重,具体为 770B-A49B 变体。该模型现已在 Hugging Face 上提供。
media
r/LocalLLaMA
·
1 小时前
·
open_models
腾讯发布 Hy4-preview 770B-A49B 权重
译自 English → 中文
相关文章
lab
Tencent Hunyuan (HF)
·
刚刚
实时
腾讯发布含770B参数的Hy4-preview MoE模型
腾讯Hy团队开源了Hy4-preview,这是一款新一代混合专家(MoE)旗舰模型,总参数量为770B,每个token激活49B参数。该架构包含78层,其中第一层使用密集前馈网络(FFN),其余77层采用具有256个路由专家的MoE结构,并配备用于推测解码的原生MTP层。
lab
Tencent Hunyuan (HF)
·
1 小时前
·
6 次浏览
实时
腾讯发布含770B参数的Hy4预览版MoE模型
腾讯Hy团队开源了Hy4预览版,这是一款新一代混合专家(Mixture-of-Experts)旗舰模型,总参数量为770B,每个token激活49B参数。该架构包含78层,其中第一层使用密集前馈网络(dense FFN),其余77层采用具有256个路由专家的MoE结构,并配备用于推测解码的原生MTP层。
lab
Tencent Hunyuan (HF)
·
3 天前
·
6 次浏览
腾讯发布 WeMM-Embedding-2B 多模态嵌入模型
腾讯发布了 WeMM-Embedding-2B,这是一个基于 Qwen3.5 构建的通用多模态嵌入模型,可接受文本、图像、视频、视觉文档和交错输入,以返回 2,048 维的 L2 归一化嵌入。
lab
Tencent Hunyuan (HF)
·
3 天前
·
15 次浏览
腾讯发布 WeMM-Embedding-4B 通用多模态嵌入模型
腾讯发布了基于 Qwen3.5 构建的通用多模态嵌入模型 WeMM-Embedding-4B,该模型接受文本、图像、视频、视觉文档和交错输入,返回 2,560 维 L2 归一化嵌入。
lab
Tencent Hunyuan (HF)
·
3 天前
·
17 次浏览
腾讯发布 WeMM-Embedding-9B 通用多模态嵌入模型
腾讯发布了基于 Qwen3.5 构建的通用多模态嵌入模型 WeMM-Embedding-9B,该模型接受文本、图像、视频、视觉文档和交错输入,以返回 4,096 维的 L2 归一化嵌入。