今週のトップ20
lab xAI News · 12時間前 · 4 回表示

xAIがGitHub CopilotにコーディングモデルGrok 4.6をリリース

xAIは、VS Codeやその他のプラットフォームを使用する開発者のために、最新のコーディングモデルであるGrok 4.6をGitHub Copilot内で利用可能にしました。ユーザーはモデルピッカーから新しいモデルを選択できますが、エンタープライズ顧客はCopilotの設定を通じて有効にする必要がある場合があります。

lab Google DeepMind Blog · 2日前 Code Arena (Elo) · 1588.0Elo · 7 回表示

Google、コーディング性能の向上と低コストを実現したGemini 3.7 Flashを発表

Googleは、コーディング、エージェントワークフロー、ナレッジワーカーの能力を強化するために設計された更新版モデルであるGemini 3.7 Flashをリリースしました。このリリースは前バージョンから3週間後に行われ、開発者のフィードバックとアルゴリズムの革新が組み込まれています。

lab OpenAI News · 2日前 BrowseComp · 84.36% · 11 回表示

OpenAIが手頃な価格で高性能なエージェントワークフローに対応するGPT-5.6をリリース

OpenAIは、推論の最適化と新しいAPI制御の導入により、大幅に低コストでフロンティアレベルのエージェント性能を実現するように設計されたGPT-5.6モデルファミリーをリリースした。このアップデートにより、スタートアップ企業は高負荷なタスクにはLunaやTerraなどの小規模モデルを使用し、複雑な判断には大規模モデルを残すことで、より高速で高性能なエージェントを構築できるようになる。

lab Google DeepMind Blog · 3日前 · 13 回表示

Google DeepMind、GboardおよびLive Transcribe向けにSL2T指文字からテキストへの変換モデルを公開

Google DeepMindとAndroidは、消費者向け製品に初めて手話AIをもたらす大規模多言語の手話からテキストへの変換(SL2T)モデルであるSL2Tを発表した。この技術は、Pixel 11におけるGboardおよびLive Transcribeでの手話からテキストへの入力支援を駆動し、まずはアメリカ手話(ASL)から英語へと対応する。

lab Google — The Keyword (AI) · 4日前 · 40 回表示

Google、AMIEを用いたリアルタイム臨床ビデオ相談能力を実証

Google ResearchとGoogle DeepMindは、医療AI研究システムAMIEを進展させ、初の試みとしてリアルタイムの臨床ビデオ相談能力を実証しました。GeminiとProject Astraに基づき、マルチエージェントアーキテクチャを使用して構築されたこのシステムは、視覚および聴覚の手がかりを解釈し、仮想身体検査を誘導し、リアルタイムで診断的推論を行います。

lab xAI News · 4日前 · 42 回表示

xAIがGrok Botをリリース、デスクトップおよびiOS向けの常時オンAIエージェント

xAIはベータ版としてGrok Botをリリースし、独自のクラウドコンピューターで動作してタスクをエンドツーエンドで処理する常時オンAIエージェントのシステムを導入しました。SuperGrok Heavy、Cursor Ultra、Cursor Teams Premiumのサブスクリバー向けにデスクトップおよびiOSで本日利用可能になり、ボットは手動ワークフロー設定なしでアプリやツール間で動作します。

lab Anthropic News · 15時間前 · 3 回表示

Claude、EU AI法規制対応のためSynthID-Text透かしを実装

Anthropicは、EU AI法およびそのAI生成コンテンツの透明性に関する行動規範への準拠のため、将来のClaudeモデルでテキスト透かしを実装する。同社はGoogle DeepMindが公開したSynthID-Text手法を使用し、出力品質や追加トークンに影響を与えることなく、生成されたテキストに検出可能なパターンを埋め込む。

lab NVIDIA Research · 15時間前 · 9 回表示

HorizonRelightはマスクされた自己条件付けを使用して、長時間のビデオリライティングの一貫性を達成

研究者たちは、タスクを時間条件付き潜在ドメイン変換として再構成することで、長時間のビデオリライティングにおける時間的不連続性に対処します。このフレームワークは、ターゲットドメインの潜在変数を境界間で伝播させることでチャンク間の連続性を強制し、マスクされたターゲットドメイン自己条件付けを使用して、この挙動を学習可能にします。

lab NVIDIA Research · 15時間前 · 11 回表示

Nvidia、ハイブリッドドメイン知識融合によるリアルタイムポートレート再照明手法「FusionRelight」を発表

Nvidiaの研究者らは、物理的に妥当な照明転送とアイデンティティの保持、コンパクトなリアルタイム推論を組み合わせるポートレート再照明手法であるFusionRelightを導入した。このアプローチは、合成データ、One-Light-at-a-Time (OLAT)、および野外データから物理学、反射率、リアリティの事前知識を学生モデルに蒸留するトレーニングフレームワークであるハイブリッドドメイン知識融合(HDKF)を利用している。

lab OpenAI News · 3日前 · 15 回表示

OpenAI、エンタープライズAIが支援から実行へ移行する中で格差拡大を報告

OpenAIの2つの新しい研究により、先駆的企業(月次AI利用量の上位10%に位置する企業)は、一般的な企業と比較してアクティブユーザーあたりの出力トークン数が8.3倍多く生成していることが明らかになった。この数値は1月の2.6倍から拡大したものである。この格差の拡大は、エンタープライズにおけるAI導入がAIを支援手段として利用することから、CodexやChatGPT Workのようなエージェント型ツールに実質的な業務を委譲することにシフトしていることを反映している。

lab NVIDIA Research · 3日前 · 40 回表示

LLMはハイパーパラメータ最適化においてベイズ最適化と同等かそれを超える

新しい論文では、基礎的な大規模言語モデル(LLM)を使用してハイパーパラメータ最適化(HPO)を自動化することが探られています。このプロセスは通常、限られた予算の状況で手動のアプローチに依存します。著者たちは、LLMがデータセットとモデルの説明に基づいてハイパーパラメータ構成を提案し、それらがモデルのパフォーマンスに応じて反復的に改善される方法論を開発しました。

lab NVIDIA Research · 3日前 · 40 回表示

Sourceがトレーニングデータ属性付けのための近似アンロール微分を導入

研究者は、影響関数の計算効率と展開ベースのアプローチの精度を組み合わせた新しいトレーニングデータ属性付け(TDA)手法であるSourceを紹介する。影響関数に似た公式を使用して展開微分を近似することにより、Sourceは最適化バイアスやマルチステージパイプラインを考慮しないという暗黙的微分手法の制限に対処する。

lab NVIDIA Research · 3日前 · 14 回表示

NVIDIAが自動運転シミュレーション向けリアルタイム生成型世界モデル「OmniDreams」をリリース

NVIDIAは、クローズドループシミュレーションにおける自動運転ポリシーの評価におけるボトルネックに対処するために設計された基盤生成型世界モデル「OmniDreams」を発表した。Cosmos拡散モデルを21,000時間の運転シナリオでミッドトレーニングおよびポストトレーニングし、リアルタイムでアクション条件付きの動画を自己回帰的に生成する。