一位Reddit用户质疑运行Qwen3.5 9B模型的GPU资源匮乏系统能否超越ChatGPT-4o等前代产品。 发帖者指出,具有视觉能力的Qwen3.5 9B Q4_K_M变体重量不到7 GB,并声称其性能远超GPT-4o。
media
r/LocalLLaMA
·
2 小时前
·
open_models
带视觉功能的Qwen3.5 9B Q4_K_M重量不到7 GB
译自 English → 中文
相关文章
arxiv
arXiv cs.CL
·
27 天前
·
4 次浏览
Intern-BioBreaker揭示前沿大语言模型中的物理生物安全风险
研究人员开发了Intern-BioBreaker,这是一种专门的生物红队测试模型,通过将计算压力测试与湿实验验证相结合,来评估前沿大型语言模型的生物风险。研究发现,经过对齐的模型可以被诱导为安全敏感任务提供操作指导,并生成具有有害特性的序列级输出。
media
r/LocalLLaMA
·
2 天前
·
9 次浏览
阿里巴巴AI模型在Hugging Face上下载量突破30亿,超越Meta和Google
根据Hugging Face发布的《State of Open Models: Summer 2026 Observations》报告,阿里巴巴的AI模型在平台上累计下载量已达30亿次。这一里程碑标志着开源格局的重大转变,因为阿里巴巴在模型总下载量上已超越Meta和Google。
media
r/LocalLLaMA
·
3 天前
·
18 次浏览
Qwen在ModelScope和Hugging Face上发布Qwen3.8-27B模型
Qwen已发布Qwen3.8-27B模型,可在ModelScope和Hugging Face上下载。
arxiv
arXiv cs.AI
·
4 天前
·
9 次浏览
VITA 临床 RAG 在 HealthBench 上匹配或超越前沿大语言模型
专为中低收入环境设计的检索增强生成系统 VITA,在 HealthBench 基准测试中与通用大型语言模型进行了对比评估。研究表明,即使随着更新的前沿模型发布,针对语料库的特定设计仍能保持具有竞争力的性能。
arxiv
arXiv cs.CL
·
4 天前
·
15 次浏览
针对特定语料的VITA RAG在HealthBench上匹配或超越前沿LLM
VITA是一个专为低收入和中等收入环境设计的检索增强生成系统,在HealthBench的英文子集上排名第一,超越了GPT-5.4、o4-mini、Gemini 3.1 Pro和Claude Sonnet 4.6。