OpenAI、推論モデルのスケール拡大に伴うAIリスクを警告
"Alien Mind"というタイトルのエッセイで、OpenAIは推論言語モデルの急速な進展と再帰的自己改善の可能性について議論している。著者は、機械知能が設計されたアルゴリズムではなく、主に計算リソースのスケーリングによって駆動されながら、変革的な方法で人間の能力を超えつつあることへの懸念を表している。
"Alien Mind"というタイトルのエッセイで、OpenAIは推論言語モデルの急速な進展と再帰的自己改善の可能性について議論している。著者は、機械知能が設計されたアルゴリズムではなく、主に計算リソースのスケーリングによって駆動されながら、変革的な方法で人間の能力を超えつつあることへの懸念を表している。
研究者らは、間接的なプロンプトインジェクション攻撃に対して大規模言語モデル(LLM)の安全なアライメントを改善するために設計されたモデルレベルのソリューションであるReasAlignを導入した。このアプローチは、ユーザーのクエリを分析し矛盾する指示を検出するために構造化された推論ステップを組み込み、ユーザーの意図したタスクの継続性を確保する。
OpenAIは、Astraよりも強力な内部モデルを使用してナビエ-ストークスの有限時間発散問題に取り組んだ。ミレニアム懸賞問題が解決されたという噂を聞き、88時間でタスクを完了した。
OpenAI関連のアカウントは、AI支援の取り組みがミレニアム懸賞問題の一つであるNavier-Stokes方程式の存在と正則性問題に関連する結果を生み出したと報告した。この主張の中心には、マルチエージェント強化学習を用いて1年間にわたって訓練された約1万のエージェントを含む協調システムがある。
OpenAIは、執筆、数学、コーディングのベンチマークにおいて前世代のGPT-5.6を大幅に上回る新モデルGPT-6 Astraをリリースしました。今回のリリースでは、3Dレンダリング、アニメーション、グラフィカルユーザーインターフェース操作におけるモデルの卓越した能力が強調されています。
研究者らは、推論トレース内のトークンの非一様な価値を活用し、Chain-of-Thought推論の高いトークン消費に対処するフレームワークであるTokenProbeを発表しました。この手法は、正規化された対数確率信号を使用して、決定的な内容を含むコアトークンと冗長なフィラーを区別します。
研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。
CosmicUndercurrentは、大規模言語モデルにおける構造的な初期化がグローバルな不整合を軽減できるかどうかを検証するために設計されたモデル非依存の推論フレームワークをオープンソース化した。このプロジェクトでは、ローカルな正しさと比較して、2段階のプロセスが全体システムの協調性を向上させるかどうかを探求している。
著者は、2つの命題間の矛盾を検出するための推論システムの研究設計を提案しています。これは、直接のLLM判断に依存するのではなく、それらをより小さなコンポーネントに分解し、論理的な衝突を検索することによって行われます。
SberbankのAI Sageは、長いコンテキストの効率化にGated DeltaNetを活用した432B-A28B Mixture of Experts (MoE)モデル「GigaChat-3.5 Reasoning」をリリースしました。
AnthropicはClaude Fable 5.1をリリースした。このモデルアップデートは、コーディング、知識作業、長時間にわたる問題解決タスクにおいて新たな基準を設定するものとなっている。