Reasoning models
arxiv arXiv cs.CL · 7時間前 · 11 回表示

TelecomGPT-R1: 異種テレコムタスクにわたる推論のための統一後学習

研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。

media Hugging Face Forums · 1日前 · 10 回表示

CosmicUndercurrentがLLMの全体システム協調をテストするためのPrincipia-Structurae-Realitatisを公開

CosmicUndercurrentは、大規模言語モデルにおける構造的な初期化がグローバルな不整合を軽減できるかどうかを検証するために設計されたモデル非依存の推論フレームワークをオープンソース化した。このプロジェクトでは、ローカルな正しさと比較して、2段階のプロセスが全体システムの協調性を向上させるかどうかを探求している。

media AI News (smol.ai) · 10日前 · 26 回表示

OpenAI、1万エージェントの協調によるNavier-Stokes特異点結果をAI支援で主張

OpenAI関連のアカウントは、AI支援の取り組みがミレニアム懸賞問題の一つであるNavier-Stokes方程式の存在と正則性問題に関連する結果を生み出したと報告した。この主張の中心には、マルチエージェント強化学習を用いて1年間にわたって訓練された約1万のエージェントを含む協調システムがある。

lab NVIDIA Research · 12日前 · 12 回表示

ReasAlignは推論を用いてLLMエージェントのプロンプトインジェクションから防御する

研究者らは、間接的なプロンプトインジェクション攻撃に対して大規模言語モデル(LLM)の安全なアライメントを改善するために設計されたモデルレベルのソリューションであるReasAlignを導入した。このアプローチは、ユーザーのクエリを分析し矛盾する指示を検出するために構造化された推論ステップを組み込み、ユーザーの意図したタスクの継続性を確保する。

media Ahead of AI · 14日前 · 28 回表示

OpenAI、強力な3Dレンダリングとコンピュータ操作機能を備えたGPT-6 Astraをリリース

OpenAIは、執筆、数学、コーディングのベンチマークにおいて前世代のGPT-5.6を大幅に上回る新モデルGPT-6 Astraをリリースしました。今回のリリースでは、3Dレンダリング、アニメーション、グラフィカルユーザーインターフェース操作におけるモデルの卓越した能力が強調されています。

lab OpenAI News · 17日前 · 34 回表示

OpenAI、推論モデルのスケール拡大に伴うAIリスクを警告

"Alien Mind"というタイトルのエッセイで、OpenAIは推論言語モデルの急速な進展と再帰的自己改善の可能性について議論している。著者は、機械知能が設計されたアルゴリズムではなく、主に計算リソースのスケーリングによって駆動されながら、変革的な方法で人間の能力を超えつつあることへの懸念を表している。

blog Simon Willison · 24日前 · 43 回表示

Tencentが1Mコンテキストを持つ770Bのテキスト専用LLM「Hy4 Preview」をリリース

中国の企業Tencentは、オープンウェイトのテキスト入力大規模言語モデルであるHy4 Previewをリリースしました。このモデルは7700億個の総パラメータと490億個のアクティブパラメータを特徴としています。今回のリリースは、295Bの総パラメータと256,000トークンのコンテキストウィンドウを持つ同年7月の以前のHy3モデルを大幅に拡張するものです。

media r/LocalLLaMA · 29日前 · 59 回表示

IBM、内蔵思考連鎖推論機能を備えたGranite 4.2ファミリーをリリース

IBMはオープンソースの推論モデル「Granite 4.2」ファミリーをリリースしました。フラッグシップの30B、ミドルサイズの8B、コンパクトな3Bのバリアントが含まれます。これらのモデルはネイティブの思考連鎖機能を活用し、数学、コーディング、複雑な多段階問題のパフォーマンスを向上させます。