Qwen已发布其Qwen 3.8 27B模型的开源权重。 该检查点可在Hugging Face上获取。
media
r/LocalLLaMA
·
3 小时前
·
open_models
Qwen发布Qwen 3.8 27B的开源权重
译自 English → 中文
相关文章
media
MarkTechPost
·
28 天前
·
6 次浏览
PrismML发布Bonsai 27B,将Qwen3.6-27B压缩至1位和三元权重
PrismML发布了Bonsai 27B,这是对Qwen3.6-27B模型的低比特量化版本,能够在不重新训练的情况下在笔记本电脑和手机上运行大型多模态模型。
media
r/LocalLLaMA
·
30 天前
UD-Q2_K_XL 格式的 Qwen3.5 122B A10B 可容纳于 64GB RAM 并提升内部知识
用户展示了使用 UD-Q2_K_XL 量化的 Qwen3.5 122B A10B 可以放入 64GB 系统 RAM 中,取代了该限制条件下的先前最佳选项。
media
r/LocalLLaMA
·
31 天前
三量化 Qwen3.6 27B 在双 RTX 3090 上以 60 tok/s 运行
一位用户报告在两块 NVIDIA RTX 3090 GPU 上成功运行了三量化的 Qwen3.6 27B 模型。该配置实现了每秒 60 个 token 的吞吐量,并具备稳定的工具调用能力。
media
r/LocalLLaMA
·
32 天前
·
3 次浏览
PrismML将Qwen3.6-27B压缩至<4GB以适配iPhone
PrismML开发了阿里巴巴开源模型Qwen 3.6的压缩版本,使拥有270亿参数的大型语言模型能够在iPhone 17 Pro上运行。该初创公司利用源自加州理工学院研究的数学技术,将模型大小从约54 GB减少到不到4 GB。
media
r/LocalLLaMA
·
40 天前
NVIDIA 发布 Qwen3.6-27B-NVFP4 模型
NVIDIA 已在 Hugging Face 上发布了 Qwen3.6-27B-NVFP4 模型。