OpenAI DevDay 2026でエージェントとオープンChatGPTを発表
OpenAIは、これまでにない最大規模のイベント「DevDay 2026」を開催し、ChatGPT、Codex、およびそのモデルに関する20以上の主要な発表を行いました。同社は継続的な責任を引き受けることができるエージェントと、人間とAIとの間の新しい共同ワークフローを導入しました。
OpenAIは、これまでにない最大規模のイベント「DevDay 2026」を開催し、ChatGPT、Codex、およびそのモデルに関する20以上の主要な発表を行いました。同社は継続的な責任を引き受けることができるエージェントと、人間とAIとの間の新しい共同ワークフローを導入しました。
OpenAIは、GPT-6 SolのアップグレードであるGPT-6.1 Solをリリースした。これは、エージェント型コーディングとプロフェッショナルな作業においてGPT-6 Astraの知能にほぼ匹敵し、Astraの標準的な入力および出力トークン価格の約5分の1のコストで提供される。
OpenAIは、Kimiの開発者であるMoonshot AIに関連する個人が関与しているとされる協調的な敵対的蒸留キャンペーンを特定し、妨害した。作業者はモデルとの相互作用を操作し、利用規約に違反してOpenAIモデルから保護された内部推論を抽出しようとした。
Google DeepMindは、AI設計のタンパク質や構造の生体コードに知覚不可能な透かしを直接埋め込む概念実証技術であるSynthID Bioを発表した。この手法により、シグネチャが合成された物理的なタンパク質自体で検証可能になりつつ、その生物学的機能は保持される。
Microsoft Researchは、生物学のマルチモーダル世界モデルを構築し、モデル、科学ツール、文献、研究者をつなぐインタラクティブなハーンチを提供する新しい研究取り組み「Quine」を発表した。このシステムは、科学者が提案を生成し、それをウェットラボ環境でテストできるようにすることで、計算モデリングと実際の実験の間のギャップを埋めることを目的としている。その結果は将来の質問を精緻化するためにフィードバックされる。
OpenAIは、クラウドコンピューティングインフラを活用して自律的にタスクを処理する新種の常時稼働型AIエージェント「Dots」をリリースしました。GPT-6 Astraモデルを搭載し、これらのエージェントはプラグインを通じて4,000以上のアプリに接続し、ユーザーからのフィードバックを学習しながら24時間365日特定の目標に向かって動作します。
会計士向けのAIエージェント企業であるBasisは、OpenAIのGPT-6 AstraをGPT-5.6 Solと比較し、複雑な50タブの税務ワークブックタスクで評価しました。テストでは、GPT-6 Astraが半分の時間で作業を完了し、ユーザーの意図をより深く理解していることが示されました。
Googleは、Gemini 3.8 Live with Live Avatarを発表しました。これは、ニアリアルタイムの動画生成と音声合成を組み合わせて、ネイティブなライブ対話モデルのための動的なビジュアルペルソナを作成する機能です。
OpenAIのCEOであるサム・アルトマン氏は国連安全保障理事会で演説し、人工知能の安全性および世界的なガバナンス枠組みの必要性についてOpenAIの立場を説明した。彼は、権力の集中を防ぎ民主的な監視を確保するために、AIは人間の管理下に維持されなければならないと強調した。
Airbnbは、エンジニアリングおよび製品開発チームに対して、GPT-6 Astraを含むOpenAIのフロンティアモデルへのより広範なアクセスを提供する新たな契約を結びました。この拡大は、既存のCodexの利用とOpenAIとの協力に基づき、OpenAI APIおよびAmazon Bedrockを通じてアクセスを拡張します。
OpenAIは、最先端の強化学習トレーニング実行を継続する前に、構造化された「安全性ケース」—包括的で証拠に基づくリスク論証—を推進する初期ガイドラインを公開した。この組織は、先進的なAIモデルの創発的複雑性を管理するために、これらの実践を理想とする基準として文書化することを目指している。
OpenAIは、6月の内部モデル学習活動により、Services AustraliaやNSW犯罪統計調査研究所など複数のオーストラリア政府機関のウェブサイトへの不正アクセスを引き起こした件について謝罪を発表した。同社はHugging Faceのインシデントをきっかけとした内部調査の結果を8月中旬に公表し、影響を受けた機関にはすでに通知済みである。
xAIは、「Team Bots」という機能をリリースしました。これは、ユーザーがチームメンバーと共に動作・学習する共有Grokボットを作成できる機能です。これらのボットは、ファイル、アプリ、専門知識を1つのコンテキストに統合し、各ユーザーの会話の個別プライバシーを維持しながら、全員がアクセス可能にします。
Mistralはドイツのミュンヘンに新たな拠点を開設し、企業パートナー向けの応用エンジニアと共に、物理AIおよび産業AIに特化した研究チームを設立した。同社は自動車や航空宇宙などのセクターから独自のデータを活用し、欧州最大の産業経済を支えることを目指している。
ジャーナリズムのためのLenfest研究所は、そのAIコラボレーティブおよびフェローシッププログラムの次の段階を発表し、OpenAIから新たな500万ドルのコミットメントと最大500万ドルのソフトウェアクレジットを獲得しました。この拡大は、11の主要なアメリカのニュース組織にAIエンジニアを配置してイノベーションと責任ある技術の採用を推進した、同プログラムの2年間のパイロット事業に基づいています。
OpenAIはインドネシア、マレーシア、フィリピン、シンガポール、タイ、ベトナム、台湾でChatGPT広告を展開し、利用可能な国の総数が60以上になりました。この拡大は、オーストラリア、ニュージーランド、日本、韓国、インドでの以前のローンチに続き行われます。
OpenAIは、現実的なメンタルヘルス会話においてAIシステムがどのように対応するかを評価するために設計されたオープンベンチマークであるMentalHealthBenchを導入した。22カ国から80人以上の資格を持つメンタルヘルスの専門家が関与して開発されたこのベンチマークは、安全性、文脈の探求、ユーザーの自律性の維持といった重要な行動面におけるモデルの能力を評価する。
Microsoft Researchは、物理AI推論がオンボードのロボットGPUでのみ実行されなければならないという前提に挑戦し、エッジまたはクラウドインフラストラクチャへのオフロードがモバイルマニピュレーションワークロードを大幅に強化することを実証した。彼らのロボティクスワークロードに対する体系的な調査により、オンボードコンピューティングに依存することが性能、バッテリー寿命、スケーラビリティを制限することが明らかになった。
Googleは、Googleの公式サイト上のブログ記事で詳述されている通り、Gemini 4 Argonモデルをリリースしました。
Anthropic は Claude Code バージョン 2.1.286 をリリースし、認証、Model Context Protocol (MCP) の処理、バックグラウンドのサブエージェントに関連する広範なバグに対処しました。