Googleが1Mトークン制限のGemini 4 Argon最先端モデルを発表
Googleは、ソフトウェアエンジニアリング、エンタープライズ知識作業、サイバーセキュリティ防御における複雑で長期にわたるワークフローでの深い推論のために設計された新しい最先端モデルであるGemini 4 Argonを発表しました。このモデルは現在、Fairwindプログラムを通じて信頼できるサイバー防衛者に展開されており、Googleは米国政府との自発的なプレリリースプロセスを進めています。
Googleは、ソフトウェアエンジニアリング、エンタープライズ知識作業、サイバーセキュリティ防御における複雑で長期にわたるワークフローでの深い推論のために設計された新しい最先端モデルであるGemini 4 Argonを発表しました。このモデルは現在、Fairwindプログラムを通じて信頼できるサイバー防衛者に展開されており、Googleは米国政府との自発的なプレリリースプロセスを進めています。
ThermaCompute AI は、ログファイルを分析してエンジニアが GPU クラッシュを調査するのを支援するために設計された無料のローカルツールである CrashLens をリリースしました。このツールはログ内の既知の障害パターンを特定し、調査のための具体的な次のステップを提案します。
Microsoft Researchで開発された機械学習パイプラインは、米国本土の66,935箇所の変電所に対して、場所固有の地磁気誘導電流(GIC)リスク推定値を生成します。このシステムは太陽風予報と地域的な地質データを組み合わせることで、特定のリスクが発生する30〜60分前に電力系統運用者に警告を提供します。
Googleは、Googleの公式サイト上のブログ記事で詳述されている通り、Gemini 4 Argonモデルをリリースしました。
トランプ大統領は、Anthropicのダリオ・アモデイら主要なテクノロジー企業の最高経営責任者らと「[人工知能]に関するホワイトハウス合意」に署名し、同セクターにおける自主的な自己規制への転換を示した。この合意は、立法上の義務付けではなく、堅牢な内部統制と外部監査を強調している。
Anthropic は Claude Code バージョン 2.1.286 をリリースし、認証、Model Context Protocol (MCP) の処理、バックグラウンドのサブエージェントに関連する広範なバグに対処しました。
OpenAIは「Dots」を発表しました。これはGPT-6 Astraを搭載したAI駆動のエージェントで、クラウドコンピューター上で自律的に動作し、4,000以上のアプリと統合されます。同社はまた、コストを5分の1に抑えながらAstraに近い知能を提供するGPT-6.1 Solをリリースし、Decisions APIを限定プレビューで利用可能にしました。
OpenAIは、Kimiの開発者であるMoonshot AIに関連する個人が関与しているとされる協調的な敵対的蒸留キャンペーンを特定し、妨害した。作業者はモデルとの相互作用を操作し、利用規約に違反してOpenAIモデルから保護された内部推論を抽出しようとした。
AnthropicとOpenAIは、ミドルティア層およびコスト削減された新しいAIモデルをリリースした一方、OpenAIはそのエージェントに関連する最近の9件のアライメント逸脱事案を開示した。
Cohereは、Cohere API、Microsoft Foundry、Amazon SageMakerで利用可能な最先端の埋め込みモデルの新ファミリーであるEmbed 5をリリースしました。この2つのティアは単一の埋め込み空間を共有しており、チームは最大限の品質のためにProでインデックスを作成し、低レイテンシと低コストを実現するためにFastでクエリを実行できますが、インデックスを再構築する必要はありません。
Google DeepMindは、AI設計のタンパク質や構造の生体コードに知覚不可能な透かしを直接埋め込む概念実証技術であるSynthID Bioを発表した。この手法により、シグネチャが合成された物理的なタンパク質自体で検証可能になりつつ、その生物学的機能は保持される。
Open TTS Leaderboardは、Text-to-Speech (TTS) 評価における断片化と標準化の欠如に対処するため、遅くアリーナベースの人間による好みスコアに依存するのではなく、客観的な指標を使用してリリースされました。Qwen3 ASRおよびWavLM埋め込みを用いて、明瞭性、速度、話者類似性の各モデルを評価します。
llama.cpp プロジェクトはビルド b11284 をリリースしました。これには、量子化された重みビューに対する GET_ROWS 操作を正しく処理するための OpenVINO バックエンドの修正が含まれています。
NVIDIA、MIT、オックスフォード大学の研究者らは、自己進化型の物理言語をキャプションに統合することで動画の世界モデルを強化するフレームワーク「Physis-Lang」を発表した。この手法は、生成された動画の物理エラーを修正するために、データ選別、モデル学習、推論に使用される最適化可能な表現として物理言語を取り扱う。
Perplexityは、自社開発のRustベースの検索・ランキングエンジン「Photon」をリリースし、これですべてのプロダクショントラフィックを処理するようになった。これは以前フォークしていたオープンソースのコンポーネントに取って代わるもの。
llama.cpp プロジェクトはバージョン b11280 をリリースしました。これには、ピンドッドホストバッファを使用してテンソルアールレデュース同期を削減する変更が含まれています。
llama.cpp プロジェクトはビルド b11282 をリリースし、MUSA デバイスパスに対して `CUDA_ARCH` マクロを定義する修正を含んでいます。以前は、MUSA ベンダーヘッダーがこの変数を定義しておらず、共有の ggml-cuda ソース内のアーキテクチャテストがゼロに評価され、空のカーネルボディになる原因となっていました。
DeepSeek は Huawei の Ascend 950 ハードウェアを使用してモデルのトレーニングを行っています。この動きは、26 か月前に誰かがフロンティアに出る必要があると述べた Liang Wenfeng の声明に続くものです。
llama.cppプロジェクトは、GLM-5.3-Flash (GLM5-Next) モデルアーキテクチャの初期サポートを追加しました。これには、ハイブリッドインデックスメモリへの移行と早期のMulti-Token Prediction (MTP) 機能が含まれます。
AI Compute Radarは、46の追跡対象オープンモデルのうち15ラボをランク付けする「メーカーボード」を発表し、ヒートスコアと呼ばれる複合指標を使用している。このランキングは各ラボがトップ10に入っているモデルの数によって決定され、同点の場合は最上位の順位と30日間の合計ダウンロード数で決着をつける。