最近
775 →
GoogleがGemini 4 Argonモデルをリリース
トランプ氏、AIに関するホワイトハウス合意に技術系リーダーらと署名
Claude Code v2.1.286 が認証、MCP、サブエージェントの問題を修正
他 772 件
Inference efficiency
271 →
llama.cpp b11284 が量子化された重みビューの OpenVINO GET_ROWS を修正
llama.cpp b11280 リリースはピンドッドホストバッファを使用してテンソルアールレデュース同期を削減
llama.cpp b11282 が MUSA デバイスパスに対して CUDA_ARCH を定義
他 268 件
AI agents
228 →
Claude Code v2.1.286 が認証、MCP、サブエージェントの問題を修正
OpenAIがDotsエージェント、GPT-6.1 Sol、Decisions APIを発表
AutoGPT Platform v0.8.2 が AutoPilot ゲーティングモードと新しい LLM を追加
他 225 件
API & product launches
127 →
GoogleがGemini 4 Argonモデルをリリース
OpenAIがDotsエージェント、GPT-6.1 Sol、Decisions APIを発表
AnthropicとOpenAIが低価格モデルをリリース;OpenAIが9件のアライメント逸脱事案を開示
他 124 件
Safety & alignment
101 →
OpenAI、Moonshot AI関連の保護された推論抽出キャンペーンを妨害
AnthropicとOpenAIが低価格モデルをリリース;OpenAIが9件のアライメント逸脱事案を開示
Google DeepMindがAI生成タンパク質に透かしを埋め込むSynthID Bioを発表
他 98 件
Local inference
95 →
llama.cpp b11284 が量子化された重みビューの OpenVINO GET_ROWS を修正
llama.cppがk-poolとMTPの修正付きでGLM-5.3-Flashサポートを追加
llama.cpp b11272 が Hexagon 連結演算を最適化
他 92 件
Open weights
77 →
Google DeepMindがAI生成タンパク質に透かしを埋め込むSynthID Bioを発表
NVIDIAがゼロショット表形式予測用のオープンなKumo Tabularファウンデーションモデルをリリース
H社がデスクトップ、Web、モバイル向けのHolo4オープンウェイトコンピュータ操作モデルをリリース
他 74 件
Code generation
75 →
Claude Code v2.1.286 が認証、MCP、サブエージェントの問題を修正
AutoGPT Platform v0.8.2 が AutoPilot ゲーティングモードと新しい LLM を追加
OpenAI、GPT-6.1 Solを Astraの5分の1のコストでエージェント型コーディング向けに導入
他 72 件
Research paper
60 →
エージェント型メタ推論は明示的な制御を通じて推論をスケーリングする
RareDxはグラフ接地型ポリシー最適化を用いて希少疾患の診断を改善する
TokenProbeは推論の品質を維持しつつCoTのトークン使用量を76%削減
他 57 件
Benchmark results
43 →
NVIDIAの研究者がCosmos 3動画モデルの物理推論を改善するPhysis-Langを公開
AI Compute RadarがヒートスコアでアリババQwenとGoogleをトップのオープンモデルラボとしてランク付け
Anthropic、GLM-5.3がサイバーレッドチームで完全な制御フローハイジャックを達成
他 40 件
Evaluation & benchmarks
41 →
Open TTS Leaderboardがスケーラブルな多言語TTS評価を公開
独立研究者が IssueTrojanBench の 42 の実プロンプト注入攻撃に対して Kavach を評価
複数ターンLLMの汚染における認識論的ポリシーの分岐に関する研究
他 38 件
Training methods
33 →
コンテキスト言語モデルはコンテキストをネイティブに編集可能なファイルとして管理する
ROFTは自己生成された説明でのファインチューニングによりエージェントモデルを改善する
研究者が知識蒸留のエンジニアリング課題における産業経験を探求
他 30 件
Hardware & chips
32 →
llama.cpp b11280 リリースはピンドッドホストバッファを使用してテンソルアールレデュース同期を削減
DeepSeek、Ascend 950 でモデルをトレーニング
AI Hardware FitはモデルのVRAM要件とGPU選択を結びつける
他 29 件
Retrieval & RAG
31 →
CohereがEmbed 5 ProとFast埋め込みモデルをリリース
PerplexityがPhotonをリリース、検索のp99レイテンシを800msから65msに削減
ProvenanceGuardがMCPエージェントにソース認識検証を追加
他 28 件
Multimodal
28 →
Microsoft Researchがマルチモーダル生物研究のためのAIシステム「Quine」を発表
llama.cpp b11240が/v1/embeddingsに型付きマルチモーダル入力サポートを追加
学部生が視覚的干渉を停止するために Qwen 2.5 Omni 3B のアーキテクチャ変更を提案
他 25 件
Voice & audio
28 →
Open TTS Leaderboardがスケーラブルな多言語TTS評価を公開
アリババのQwenチームが全二重音声モデル「Qwen-Audio-3.1-Realtime」をリリース
llama.cpp b11190 が LFM2 audio の mel プリプロセッサを修正
他 25 件
Policy & regulation
21 →
トランプ氏、AIに関するホワイトハウス合意に技術系リーダーらと署名
OpenAI、整合性失敗によりAstra 6.1のリリースを中止
Lenfest研究所がOpenAIからの500万ドルの資金提供によりAIフェローシップを拡大
他 18 件
Image generation
14 →
AutoRefがマルチリファレンス画像生成のためのエージェントハーネスを最適化
Hung Tran氏、過学習ニューラル画像コーデックにおけるクリッピングの罠を特定
MetaがMuseコネクタを公開、SAM 3.1をリリース、Geminiがシステムをハッキング
他 11 件
Video generation
13 →
NVIDIAの研究者がCosmos 3動画モデルの物理推論を改善するPhysis-Langを公開
Google Researchが、一貫性のある数分間の動画生成のための4つのエージェント型フレームワークを導入
Runwayがリアルタイムインタラクティブな世界生成のためのWorldPromptを発表
他 10 件
Reasoning models
11 →
TokenProbeは精度を維持しながらCoTトークン使用量を76%削減
TelecomGPT-R1: 異種テレコムタスクにわたる推論のための統一後学習
CosmicUndercurrentがLLMの全体システム協調をテストするためのPrincipia-Structurae-Realitatisを公開
他 8 件