あるRedditユーザーは、Qwen3.5 9Bモデルを実行するGPU不足のシステムがChatGPT-4oなどの前世代を上回るかどうか疑問視しています。 投稿者は、ビジョン機能を持つQwen3.5 9B Q4_K_Mバリアントの重量が7 GB未満であり、パフォーマンスにおいてGPT-4oを大幅に上回ると主張しています。
media
r/LocalLLaMA
·
2時間前
·
open_models
ビジョン機能付きQwen3.5 9B Q4_K_Mは7 GB未満
翻訳元 English → 日本語
関連記事
arxiv
arXiv cs.CL
·
27日前
·
4 回表示
Intern-BioBreakerが最先端LLMにおける物理的なバイオセキュリティリスクを明らかに
研究者らは、Intern-BioBreakerを開発した。これは特殊なバイオレッドチームイングモデルであり、計算負荷テストと湿式実験検証を組み合わせることで、最先端の大規模言語モデルの生物学的リスクを評価するものである。本研究では、アラインメント済みモデルが安全に敏感なタスクに対する運用ガイダンスを提供するように誘導され、有害な性質を持つシーケンスレベルの出力を生成できることが判明した。
media
r/LocalLLaMA
·
2日前
·
9 回表示
AlibabaのAIモデルがHugging Faceで30億回のダウンロードを達成し、MetaやGoogleを凌駕
Hugging Faceによる「State of Open Models: Summer 2026 Observations」レポートによると、AlibabaのAIモデルはプラットフォーム上で累計30億回のダウンロードに達しました。このマイルストーンはオープンソースの状況における重要な転換点を示しており、Alibabaは総モデルダウンロード数においてMetaおよびGoogleをすでに上回っています。
media
r/LocalLLaMA
·
3日前
·
18 回表示
QwenがModelScopeとHugging FaceにQwen3.8-27Bモデルをリリース
QwenはQwen3.8-27Bモデルをリリースし、ModelScopeおよびHugging Faceでダウンロード可能です。
arxiv
arXiv cs.AI
·
4日前
·
9 回表示
VITAの臨床用RAGはHealthBenchにおいて最先端LLMと同等かそれ以上の性能を示す
低所得・中所得環境向けに設計された、VITAという目的特化型の検索拡張生成システムが、HealthBenchベンチマークを用いて汎用大規模言語モデルと比較評価された。本研究は、コーパス固有の設計により、新しい最先端モデルがリリースされても競争力のある性能を維持できることを示している。
arxiv
arXiv cs.CL
·
4日前
·
15 回表示
Corpus固有のVITA RAGはHealthBenchで最先端LLMに匹敵または上回る
低所得・中所得環境向けに設計された検索拡張生成システムであるVITAは、HealthBenchの英語版サブセットで1位となり、GPT-5.4、o4-mini、Gemini 3.1 Pro、Claude Sonnet 4.6を上回った。