ソース · r/LocalLLaMA
media r/LocalLLaMA · 1日前 · 1 回表示

Anthropicの研究、GLM-5と高度なサイバー能力の拡散を関連付け

Anthropicは「GLM-5.3と高度なサイバー能力の拡散」と題した研究論文を発表し、GLM-5などのオープンソースモデルが悪意のあるサイバー活動にどのように利用されているかを検討しています。 記事では、これらのモデルが脅威アクターによって広く採用され、セキュリティコミュニティ内でその能力を宣伝する役割を果たしていることが強調されています。 この分析は、高度なAIモデルの二重使用性質とそのサイバー脅威を増幅させる可能性に関する懸念の高まりを示しています。

media r/LocalLLaMA · 1日前 · 3 回表示

IQuestLabがエージェント型コーディング用の320B MoEモデル「IQuest-Q1」をリリース

IQuestは、エージェント型コーディング、推論、マルチステップツール使用のために設計されたMixture-of-Experts (MoE)モデルであるIQuest-Q1をリリースしました。 このモデルは約3200億の総パラメータを持ち、トークンあたり約150億のパラメータが活性化されます。 Hugging Faceで利用可能です。

media r/LocalLLaMA · 2日前 · 4 回表示

NVIDIA、エージェント向けにランタイム制限付きのOpenShellサンドボックスを出荷

NVIDIAは、ローカルおよびオープンなAIエージェントに対してプロンプトルールのみを頼りにするのではなく、実際のランタイム制限を提供するように設計されたオープンソースのサンドボックスであるOpenShellをリリースしました。同社は、このセキュリティスタックに100社以上が参加していると報告していますが、OpenAIは参加していません。

media r/LocalLLaMA · 7日前 · 43 回表示

AppleがLensVLM-9Bをリリース、圧縮されたテキスト画像を選択的に拡張するVLM

Appleは、テキストの圧縮画像をより効率的に処理するために設計された90億パラメータのVision Language ModelであるLensVLM-9Bをリリースしました。このモデルはこれらの圧縮入力をスキャンし、学習したツールを使用して関連するページのみを選択的に非圧縮形式に拡張します。