GPT-5.5 Instantは、より強力な推論、改善されたコンテキスト処理、明確なコミュニケーション、医師による評価を通じて、ChatGPTの健康およびウェルネス関連の回答を向上させます。
GPT-5.5 InstantがChatGPTの健康回答を強化
Buddy System: 階層型LLM推論のためのNERゲート付き不確実性を用いたRustエントロピーモニタ
Buddy Systemは、ローカルのGemma 3 4B推論におけるトークンごとの不確実性を検出するためにRustエントロピーモニタを使用し、NERゲート付きスパン抽出およびセマンティック検索を通じて不確実なトークンのみをSonnetにルーティングします。ベンチマークでは、$0.21で71.4%の精度を達成し、7つのHugging FaceデータセットにおいてAnthropic Advisorパターン($0.44で62.9%)を上回り、SQuAD v2ではソースパッセージチャンクをクラウドモデルにルーティングすることで重要な改善を実現しました。
Anthropicがハイブリッド推論機能を備えたClaude Opus 4およびSonnet 4をリリース
Anthropicは、素早い応答と段階的な思考プロセスを統合する「ハイブリッド推論」機能を提供する2つの新しい大規模言語モデル、Claude Opus 4とClaude Sonnet 4をリリースしました。これらのモデルはClaude 3.x世代に取って代わり、200,000トークンのコンテキストウィンドウを維持しつつ、安全性とエージェント機能の向上を実現しています。
Googleが100万トークンコンテキストを備えた実験的なGemini 2.5 Pro推論モデルをリリース
Googleは、Gemini 2.5ファミリー初のモデルであり、これまでの最も高性能な推論モデルであるGemini 2.5 Proをリリースしました。このモデルは100万トークンの入力コンテキストウィンドウを搭載しており(拡張の計画あり)、テキスト、画像、音声、動画を含むマルチモーダル入力をサポートし、現在Gemini AdvancedプランおよびGoogle AI Studioを通じて利用可能です。
xAIが推論能力を強化し128Kのコンテキストに対応したGrok-1.5をリリース
xAIは、強化された推論機能と最大128,000トークンのコンテキストウィンドウを備えた新モデル「Grok-1.5」を発表しました。このモデルは、今後数日以内に𝕏プラットフォーム上で早期テスターおよび既存ユーザーに提供されます。
TelecomGPT-R1: 異種テレコムタスクにわたる推論のための統一後学習
研究者らは、TelecomGPT-R1を発表した。これは、規格、構成、ログに対する推論を通じてエンジニアリングタスクを自動化するために設計された、オープンソースの統一型テレコム推論モデルファミリーである。このモデルは、プロトコル、知識、モデリング、障害の各軸をカバーする構造化アプローチを通じて、既存の汎用および専門的なLLMの制限に対処する。