← 返回 media r/LocalLLaMA · 1 小时前 · open_models Reflection AI 发布 Beam 501B 开源权重模型 译自 English → 中文 Reflection AI 宣布发布 Beam,这是一个拥有 501B 参数的开源权重语言模型。该模型采用具有 230 亿激活参数的架构。 Beam 拥有 501B 总参数和 23B 激活参数。它被描述为比 GLM 5.2 等可比模型更具令牌效率。此次发布被形容为 Inkling 系列的改进。 重要性 2/3 r/LocalLLaMA Open weights 阅读原文 相关文章 media Hugging Face Forums · 1 小时前 · 1 次浏览 实时 Dev-4B将快速校准决策与基于风险推理升级相结合 作者发布了 Dev-4B,这是一个基于 Qwen3-4B-Instruct 的小型本地模型,能够以校准后的置信度回答关于文档的输入问题。它使用内置路由器决定是提供快速答案,还是仅在初始预测可能错误时升级到逐步推理。 media Hugging Face Forums · 14 小时前 · 6 次浏览 OncoLLM 使用 Unsloth 将 MedGemma 4B 和 27B 适配到肿瘤学任务 研究人员使用 Unsloth 对 MedGemma 4B 和 27B 模型进行了微调,以用于肿瘤学任务,并在单个 DGX Spark 上完成了该过程。生成的 OncoLLM 模型、训练数据集以及详细报告均已公开。 media r/LocalLLaMA · 14 小时前 · 3 次浏览 Reflection AI将发布与美国开源模型竞争DeepSeek和Qwen的模型 Reflection AI正准备发布一款新的开源人工智能模型,旨在与现有的DeepSeek和Qwen产品竞争。 media MarkTechPost · 1 天前 · 34 次浏览 Aleph Alpha 发布 Kolibri,一款拥有 78.1B 英德双语 MoE 模型及 3.46B 激活参数 Aleph Alpha 发布了 Kolibri-1,这是一款专为英德双语任务设计的开源权重混合专家语言模型。该模型总共包含 781 亿个参数,但每个 token 仅激活 34.6 亿个,使其能够在单张 B200、B300 或 H200 GPU 上运行。 media Hugging Face Forums · 2 天前 · 17 次浏览 Hmar Heritage Foundation发布HmarBERT模型和数据集 Hmar Heritage Foundation发布了Hugging Face上的HmarBERT空间,并公开了其相关数据集。该倡议旨在为Hmar语言提供数字资源,而该语言此前缺乏显著的在线存在感。
media Hugging Face Forums · 1 小时前 · 1 次浏览 实时 Dev-4B将快速校准决策与基于风险推理升级相结合 作者发布了 Dev-4B,这是一个基于 Qwen3-4B-Instruct 的小型本地模型,能够以校准后的置信度回答关于文档的输入问题。它使用内置路由器决定是提供快速答案,还是仅在初始预测可能错误时升级到逐步推理。
media Hugging Face Forums · 14 小时前 · 6 次浏览 OncoLLM 使用 Unsloth 将 MedGemma 4B 和 27B 适配到肿瘤学任务 研究人员使用 Unsloth 对 MedGemma 4B 和 27B 模型进行了微调,以用于肿瘤学任务,并在单个 DGX Spark 上完成了该过程。生成的 OncoLLM 模型、训练数据集以及详细报告均已公开。
media r/LocalLLaMA · 14 小时前 · 3 次浏览 Reflection AI将发布与美国开源模型竞争DeepSeek和Qwen的模型 Reflection AI正准备发布一款新的开源人工智能模型,旨在与现有的DeepSeek和Qwen产品竞争。
media MarkTechPost · 1 天前 · 34 次浏览 Aleph Alpha 发布 Kolibri,一款拥有 78.1B 英德双语 MoE 模型及 3.46B 激活参数 Aleph Alpha 发布了 Kolibri-1,这是一款专为英德双语任务设计的开源权重混合专家语言模型。该模型总共包含 781 亿个参数,但每个 token 仅激活 34.6 亿个,使其能够在单张 B200、B300 或 H200 GPU 上运行。
media Hugging Face Forums · 2 天前 · 17 次浏览 Hmar Heritage Foundation发布HmarBERT模型和数据集 Hmar Heritage Foundation发布了Hugging Face上的HmarBERT空间,并公开了其相关数据集。该倡议旨在为Hmar语言提供数字资源,而该语言此前缺乏显著的在线存在感。