Google、コーディング性能の向上と低コストを実現したGemini 3.7 Flashを発表
Googleは、コーディング、エージェントワークフロー、ナレッジワーカーの能力を強化するために設計された更新版モデルであるGemini 3.7 Flashをリリースしました。このリリースは前バージョンから3週間後に行われ、開発者のフィードバックとアルゴリズムの革新が組み込まれています。
Googleは、コーディング、エージェントワークフロー、ナレッジワーカーの能力を強化するために設計された更新版モデルであるGemini 3.7 Flashをリリースしました。このリリースは前バージョンから3週間後に行われ、開発者のフィードバックとアルゴリズムの革新が組み込まれています。
OpenAIは、推論の最適化と新しいAPI制御の導入により、大幅に低コストでフロンティアレベルのエージェント性能を実現するように設計されたGPT-5.6モデルファミリーをリリースした。このアップデートにより、スタートアップ企業は高負荷なタスクにはLunaやTerraなどの小規模モデルを使用し、複雑な判断には大規模モデルを残すことで、より高速で高性能なエージェントを構築できるようになる。
DeepSeek-V4-Proの一般提供がAPP、Web、APIプラットフォームで展開されました。このアップデートは、OpenAI Responses APIフォーマットへのネイティブサポートを導入しながら、本番環境でのエージェントパフォーマンスを大幅に向上させます。
xAIは、長時間実行のエージェントと複雑なインタラクティブ作業に焦点を当てたモデルのアップデートであるGrok 4.6をリリースしました。新バージョンはArtificial Analysis Intelligence IndexでGPT-5.6 Solと同等であり、Cursor、Grok Build、およびAPI経由で利用可能です。
OpenAIの内部モデルAstraは、数学および理論計算機科学にわたる10の長年の未解決問題に対する解答を生成し、その論証はLeanで形式化された。これらの結果は高次元幾何学、符号理論、群論、量子複雑性にまたがり、少なくとも10年間進展が見られなかった問いに対処している。
Googleは、適応型ロボットにインテリジェントな全身制御、高度な器用さ、チームでの協力能力を提供するように設計されたインテリジェンスレイヤーであるGemini Robotics 2を導入しました。このアップデートは、物理的なAIの能力を狭く反復的なタスクを超えて拡張し、ロボットが動きについて推論し、新しい身体に迅速に適応できるようにします。
GPT-5.6は、モデルアーキテクチャ、推論プロセス、エージェントワークフローを含む複数の次元において人工知能の効率を強化します。
Googleは、Flashシリーズの3つの新しいモデル、Gemini 3.6 Flash、3.5 Flash-Lite、および3.5 Flash Cyberを発表しました。これらは、生産環境でのAIエージェント向けにトークン効率、レイテンシ、信頼性の向上を目指して設計されています。
Anthropicは、長時間実行のエージェントを駆動し、コーディングおよび専門的な作業において大幅な改善をもたらすために設計された新しいモデルであるClaude Opus 5をリリースしました。これはOpusティアにおける段階的な改善として位置づけられ、コストを半分に抑えながらClaude Fable 5に迫るパフォーマンスを提供します。
Google ResearchとGoogle DeepMindは、医療AI研究システムAMIEを進展させ、初の試みとしてリアルタイムの臨床ビデオ相談能力を実証しました。GeminiとProject Astraに基づき、マルチエージェントアーキテクチャを使用して構築されたこのシステムは、視覚および聴覚の手がかりを解釈し、仮想身体検査を誘導し、リアルタイムで診断的推論を行います。
xAIはベータ版としてGrok Botをリリースし、独自のクラウドコンピューターで動作してタスクをエンドツーエンドで処理する常時オンAIエージェントのシステムを導入しました。SuperGrok Heavy、Cursor Ultra、Cursor Teams Premiumのサブスクリバー向けにデスクトップおよびiOSで本日利用可能になり、ボットは手動ワークフロー設定なしでアプリやツール間で動作します。
OpenAIは、承認された防衛チームが新たに導入されたGPT-5.6-Cyberモデルを使用して高度なサイバーセキュリティ機能を利用できるようにするため、OpenAI Daybreakプログラムに2つの新しいアクセス層—Daybreak BlueとDaybreak Red—を追加して拡大している。
Anthropicは、今後のモデルであるAstraに関連する内部活動を一時停止しました。これは、最近の評価により、同社の準備フレームワークの下でクリティカルなサイバーセキュリティ能力を備えている可能性が示されたためです。同社は、人間による介入なしに、強化された実世界のシステムにおいて機能的なゼロデイエクスプロイトを特定・開発できる可能性を排除できません。
OpenAIは、従来のターン検出器を排除し、同時に聴取と発話ができるフルデュプレックスモデルを使用して、第三世代の音声システム「GPT-Live」をリリースした。このアーキテクチャにより、リアルタイムパフォーマンスに最適化された新しいシステム設計を通じて低レイテンシを維持しながら、より即座で自然な会話が可能になる。
Microsoft Researchは、自律型エージェントのスケーラブルかつ費用対効果の高い研究を可能にするために設計されたオープンソースのフレームワークであるOrchardをリリースしました。このシステムは、Kubernetesベースの環境サービスであるOrchard Envを中心に据えており、研究者がインフラを再構築することなく、ソフトウェアエンジニアリング、ウェブナビゲーション、パーソナルアシスタンスなど多様なドメインでエージェントのトレーニングと評価を行うことを可能にします。
OpenAIは、そのGPT-5.6モデルファミリーに対して大幅な価格引き下げを発表し、GPT-5.6 Lunaのコストを80%、GPT-5.6 Terraのコストを20%削減した。同社はこれらの変更を、インフラ効率の改善を通じて高度なAIをより手頃な価格で広く利用可能にするというより広範な戦略の一環として位置づけている。
DeepSeekは、V4-Pro-Previewと比較して大幅に強化されたエージェント機能を持つDeepSeek-V4-Flash APIの公式パブリックベータをリリースしました。このアップデートでは、元のアーキテクチャとサイズを維持したままモデルを再トレーニングしています。
Microsoft Researchは、コンピュータ使用エージェントのトレーニング用に設計された12の深い合成環境のコレクションであるEchoverseをリリースしました。このイニシアチブには、ドメイン固有の世界10と能力焦点の世界2が含まれており、すべて一貫した状態と行動の忠実度を維持するように構築されています。
Googleは、ロボットが高速に思考しリアルタイムで多段階のタスクを計画できるように設計された新しい具現化推論モデルであるGemini Robotics ER 2を発売しました。今回のアップデートでは、以前のER 1.6バージョンと比較して大幅な改善がもたらされ、動画ベースの継続的な進捗追跡、精密な瞬間特定、ネイティブなマルチロボット協調機能が含まれています。
xAIは、SuperGrok Heavyのサブスクライバー向けに早期ベータ版で利用可能な新機能「Build Mode」を発表しました。これにより、ユーザーはGrokチャットインターフェース内で直接ウェブサイト、アプリ、ゲーム、インタラクティブなダッシュボードを作成できます。