← 返回 media r/LocalLLaMA · 2 小时前 · open_models MiniMax在Hugging Face上发布H3全模态生成系统 译自 English → 中文 MiniMax已将其MiniMax-H3模型在Hugging Face上开放。这个通用全模态生成系统支持对由文本、图像、视频和音频组成的多模态上下文的统一理解。 它可以生成具有原生立体声的2K分辨率视频,时长长达15秒。该模型在预训练阶段具备广泛的多模态上下文理解和生成能力。这种设计使其在遵循复杂多模态指令方面表现出色。 重要性 2/3 r/LocalLLaMA MiniMax Multimodal Open weights 阅读原文 相关文章 media MarkTechPost · 9 小时前 · 1 次浏览 Thinking Machines Lab 发布 Inkling-Small,一款拥有 276B 开放权重的多模态 MoE 模型 Thinking Machines Lab 发布了 Inkling-Small,这是一个拥有 2760 亿总参数和 120 亿激活参数的开放权重混合专家(MoE)模型。该模型能够原生地对文本、图像和音频进行推理,具备 1M token 上下文窗口和可调节的思考力度。 media Interconnects · 19 小时前 · 10 次浏览 Thinking Machines发布Inkling,腾讯以Apache 2.0许可证更新Hy3 最新的开源模型成果汇总突出了Thinking Machines和腾讯的重大发布,以及Poolside和DeepSeek的更新。 media r/LocalLLaMA · 3 天前 · 6 次浏览 MiniMax 发布 MiniMax H3 视频模型,开源权重即将推出 MiniMax 推出了 MiniMax H3,这是一款通用的多模态生成模型,能够理解文本、图像、视频和音频的统一上下文。该模型可生成带有原生立体声的视频,时长长达 15 秒,分辨率为 2K。 github llama.cpp · 7 天前 · 1 次浏览 llama.cpp b10142 添加对 MiniMax-M3 视觉支持的初步支持 llama.cpp 项目发布了构建版本 b10142,为 MiniMax-M3 模型引入了初步的视觉支持。此次更新实现了一个仅文本的端口,复用了来自 MiniMax-M2 的现有组件,包括带有每头 QK 归一化和部分旋转编码的 GQA、DeepSeek-V3 风格的专家网络以及 swigluoai 激活函数。 media r/LocalLLaMA · 10 天前 瑞士AI发布Apertus 1.5多模态模型,具备思考模式 瑞士AI发布了Apertus 1.5,这是一系列包含8B和70B参数量的语言模型,引入了多模态能力和新的推理功能。此次更新涉及在额外的4T token(针对8B模型)和2T token(针对70B模型)的多模态混合数据上继续进行预训练。
media MarkTechPost · 9 小时前 · 1 次浏览 Thinking Machines Lab 发布 Inkling-Small,一款拥有 276B 开放权重的多模态 MoE 模型 Thinking Machines Lab 发布了 Inkling-Small,这是一个拥有 2760 亿总参数和 120 亿激活参数的开放权重混合专家(MoE)模型。该模型能够原生地对文本、图像和音频进行推理,具备 1M token 上下文窗口和可调节的思考力度。
media Interconnects · 19 小时前 · 10 次浏览 Thinking Machines发布Inkling,腾讯以Apache 2.0许可证更新Hy3 最新的开源模型成果汇总突出了Thinking Machines和腾讯的重大发布,以及Poolside和DeepSeek的更新。
media r/LocalLLaMA · 3 天前 · 6 次浏览 MiniMax 发布 MiniMax H3 视频模型,开源权重即将推出 MiniMax 推出了 MiniMax H3,这是一款通用的多模态生成模型,能够理解文本、图像、视频和音频的统一上下文。该模型可生成带有原生立体声的视频,时长长达 15 秒,分辨率为 2K。
github llama.cpp · 7 天前 · 1 次浏览 llama.cpp b10142 添加对 MiniMax-M3 视觉支持的初步支持 llama.cpp 项目发布了构建版本 b10142,为 MiniMax-M3 模型引入了初步的视觉支持。此次更新实现了一个仅文本的端口,复用了来自 MiniMax-M2 的现有组件,包括带有每头 QK 归一化和部分旋转编码的 GQA、DeepSeek-V3 风格的专家网络以及 swigluoai 激活函数。
media r/LocalLLaMA · 10 天前 瑞士AI发布Apertus 1.5多模态模型,具备思考模式 瑞士AI发布了Apertus 1.5,这是一系列包含8B和70B参数量的语言模型,引入了多模态能力和新的推理功能。此次更新涉及在额外的4T token(针对8B模型)和2T token(针对70B模型)的多模态混合数据上继续进行预训练。