トピック · Reasoning models
lab OpenAI News · 24日前 · 40 回表示

OpenAI、推論モデルのスケール拡大に伴うAIリスクを警告

"Alien Mind"というタイトルのエッセイで、OpenAIは推論言語モデルの急速な進展と再帰的自己改善の可能性について議論している。著者は、機械知能が設計されたアルゴリズムではなく、主に計算リソースのスケーリングによって駆動されながら、変革的な方法で人間の能力を超えつつあることへの懸念を表している。

lab NVIDIA Research · 19日前 · 13 回表示

ReasAlignは推論を用いてLLMエージェントのプロンプトインジェクションから防御する

研究者らは、間接的なプロンプトインジェクション攻撃に対して大規模言語モデル(LLM)の安全なアライメントを改善するために設計されたモデルレベルのソリューションであるReasAlignを導入した。このアプローチは、ユーザーのクエリを分析し矛盾する指示を検出するために構造化された推論ステップを組み込み、ユーザーの意図したタスクの継続性を確保する。

media AI News (smol.ai) · 18日前 · 31 回表示

OpenAI、1万エージェントの協調によるNavier-Stokes特異点結果をAI支援で主張

OpenAI関連のアカウントは、AI支援の取り組みがミレニアム懸賞問題の一つであるNavier-Stokes方程式の存在と正則性問題に関連する結果を生み出したと報告した。この主張の中心には、マルチエージェント強化学習を用いて1年間にわたって訓練された約1万のエージェントを含む協調システムがある。

media Ahead of AI · 21日前 · 31 回表示

OpenAI、強力な3Dレンダリングとコンピュータ操作機能を備えたGPT-6 Astraをリリース

OpenAIは、執筆、数学、コーディングのベンチマークにおいて前世代のGPT-5.6を大幅に上回る新モデルGPT-6 Astraをリリースしました。今回のリリースでは、3Dレンダリング、アニメーション、グラフィカルユーザーインターフェース操作におけるモデルの卓越した能力が強調されています。

arxiv arXiv cs.CL · 2日前 · 1 回表示

TokenProbeは精度を維持しながらCoTトークン使用量を76%削減

研究者らは、推論トレース内のトークンの非一様な価値を活用し、Chain-of-Thought推論の高いトークン消費に対処するフレームワークであるTokenProbeを発表しました。この手法は、正規化された対数確率信号を使用して、決定的な内容を含むコアトークンと冗長なフィラーを区別します。

arxiv arXiv cs.CL · 8日前 · 19 回表示

TelecomGPT-R1: 異種テレコムタスクにわたる推論のための統一後学習

研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。

media Hugging Face Forums · 9日前 · 14 回表示

CosmicUndercurrentがLLMの全体システム協調をテストするためのPrincipia-Structurae-Realitatisを公開

CosmicUndercurrentは、大規模言語モデルにおける構造的な初期化がグローバルな不整合を軽減できるかどうかを検証するために設計されたモデル非依存の推論フレームワークをオープンソース化した。このプロジェクトでは、ローカルな正しさと比較して、2段階のプロセスが全体システムの協調性を向上させるかどうかを探求している。