ラボ · Zhipu AI
media r/LocalLLaMA · 1日前 · 1 回表示

Anthropicの研究、GLM-5と高度なサイバー能力の拡散を関連付け

Anthropicは「GLM-5.3と高度なサイバー能力の拡散」と題した研究論文を発表し、GLM-5などのオープンソースモデルが悪意のあるサイバー活動にどのように利用されているかを検討しています。 記事では、これらのモデルが脅威アクターによって広く採用され、セキュリティコミュニティ内でその能力を宣伝する役割を果たしていることが強調されています。 この分析は、高度なAIモデルの二重使用性質とそのサイバー脅威を増幅させる可能性に関する懸念の高まりを示しています。

arxiv arXiv cs.CL · 2日前 · 1 回表示

複数ターンLLMの汚染における認識論的ポリシーの分岐に関する研究

"複数ターンLLC汚染における認識論的ポリシーの分岐:プロトコル勾配調査"と題された研究は、会話履歴に注入された誤った前提を大規模言語モデルがどのように処理するかを評価するものであり、この失敗モードはセッションレベルの汚染と呼ばれています。研究者たちは、温度ゼロで22,500ターンを用いて10の知識領域においてGPT-5.4 Mini、Gemini-3.1 Flash-Lite、GLM-4.5-Airをテストしました。

arxiv arXiv cs.CL · 8日前 · 19 回表示

TelecomGPT-R1: 異種テレコムタスクにわたる推論のための統一後学習

研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。

arxiv arXiv cs.LG · 9日前 HealthBench · 50.1% · 13 回表示

Fathom-Vaidya、ルーブリックベースの報酬で医療推論を改善

著者は、診断および臨床ヘルスケアの推論を強化するために合成データとルーブリックベースの強化学習を使用する30BパラメータのモデルであるFathom-Vaidyaを紹介します。トレーニングフレームワークはまず、診断のためにMedBullets由来の質問にルール誘導型RLを適用し、その後、対話型臨床タスクのために多次元ルーブリックを持つ5.3kの合成マルチターンシナリオを利用します。

arxiv arXiv cs.CL · 14日前 · 24 回表示

Wikipedia上のlog(N)質問ゲームでフロンティアモデルを評価

ある研究では、6つのフロンティア言語モデルが、質問者がN個のWikipediaのパラグラフからターゲットを正確にlog2(N)回のyes/no質問で特定する2エージェント間の通信タスクにおいて評価された。実験は4〜1024パラグラフのドキュメントセット全体で408ゲームを実行し、テストされたモデル間で顕著なパフォーマンスの格差が明らかになった。

media r/LocalLLaMA · 17日前 · 25 回表示

InternLMが科学知能向けに397BパラメータのマルチモーダルモデルIntern-S2-397Bをリリース

InternLMは、科学知能と長期ホライゾンのエージェント向けに設計された3970億パラメータのマルチモーダル基盤モデルであるIntern-S2-397Bを発表しました。このモデルは、事前トレーニング、強化学習タスクのカバレッジ、インタラクティブなエージェント環境全体でスケーリングし、一般的な推論能力とエージェント機能を強化します。

arxiv arXiv cs.CL · 21日前 · 33 回表示

GLM-5.3-Flashに対する単方向攻撃がMoEモデルの安全アライメントの脆弱性を明らかにする

研究者たちは、重みから単一方向を投影して拒否を除去するホワイトボックス攻撃である方向性アブレーションが、GLM-5.3-Flashのような最先端の混合专家(MoE)モデルに対して依然として有効であることを実証した。本研究は、この攻撃がアーキテクチャを生き残る一方で、その効果が1つの場所に集中するのではなく、注意機構、密結合層、ルーティングされた专家の書き込み器全体に分散されていることを示している。