最近
812 →
Claude Code v2.1.233がGitLab MRサポート、メモリ制限を追加し、新モデルでtodoツールを無効化
xAIがGitHub CopilotにコーディングモデルGrok 4.6をリリース
Z.aiが拡張されたポストトレーニング付きGLM-5.3をリリース
他 809 件
AI agents
252 →
Claude Code v2.1.233がGitLab MRサポート、メモリ制限を追加し、新モデルでtodoツールを無効化
OpenAIがGPT-5.6 SolのUltrafastモードをプレビュー;GoogleがGemini 3.7 Flashをリリース
MetaがMuse Codeのエージェント型ハーネスと低コストのMuse Spark 1.2モデルをリリース
他 249 件
Inference efficiency
187 →
llama.cpp b10434 が reasoning_effort をテンプレートに渡す
Nvidia、ハイブリッドドメイン知識融合によるリアルタイムポートレート再照明手法「FusionRelight」を発表
llama.cpp b10431 が SSM モデルの再帰的状態ロールバックを追加
他 184 件
Open weights
170 →
Z.aiが拡張されたポストトレーニング付きGLM-5.3をリリース
オープンモデルの現状:2026年夏の観察
QwenがQwen 3.8 27Bのオープンウェイトをリリース
他 167 件
API & product launches
115 →
xAIがGitHub CopilotにコーディングモデルGrok 4.6をリリース
OpenAIがGPT-5.6 SolのUltrafastモードをプレビュー;GoogleがGemini 3.7 Flashをリリース
Mistral、GLM-5.2をMistral Medium 3.5より低価格でホスト
他 112 件
Code generation
99 →
Claude Code v2.1.233がGitLab MRサポート、メモリ制限を追加し、新モデルでtodoツールを無効化
xAIがGitHub CopilotにコーディングモデルGrok 4.6をリリース
MetaがMuse Codeのエージェント型ハーネスと低コストのMuse Spark 1.2モデルをリリース
他 96 件
Safety & alignment
78 →
Claude、EU AI法規制対応のためSynthID-Text透かしを実装
Muse-LtdがLLMの認識論的キャリブレーションのためのUncertaintyGymベンチマークを提出
OpenAIのエージェントがArtifactoryを介してHugging Faceに誤って攻撃
他 75 件
Research paper
74 →
HorizonRelightはマスクされた自己条件付けを使用して、長時間のビデオリライティングの一貫性を達成
Faraday 27B が論文再現タスクにおいて Claude Opus 4.8 および GPT-5.5 を上回る
Faraday 27B が論文再現タスクで Claude Opus 4.8 および GPT-5.5 を上回る
他 71 件
Benchmark results
59 →
Z.aiが拡張されたポストトレーニング付きGLM-5.3をリリース
QwenがModelScopeとHugging FaceにQwen3.8-27Bモデルをリリース
Gemini 3.7 Flash アップデートで GDM が再び注目される
他 56 件
Local inference
51 →
llama.cpp b10434 が reasoning_effort をテンプレートに渡す
オープンモデルの現状:2026年夏の観察
llama.cpp b10418 が SYCL のホストピンドメモリサポートを追加
他 48 件
Training methods
45 →
ThetaMemは固定状態シーケンスメモリに対して符号付き乗算キーリフトを提案
Dyna Roboticsが、100万時間分の人間の動画で事前学習された世界行動モデル「Dyna-2」をリリース
LLMはハイパーパラメータ最適化においてベイズ最適化と同等かそれを超える
他 42 件
Multimodal
41 →
Intern-S2-Preview: 科学用アジェンティック基盤モデル
dots-studioが280B MoEモデル「dots3-note preview」をリリース
Liquid AIがツール呼び出し機能を備えた3Bのオンデバイスビジョン言語モデルLFM2.5-VL-3Bをリリース
他 38 件
Policy & regulation
37 →
Claude、EU AI法規制対応のためSynthID-Text透かしを実装
ホワイトハウスがAI政策を拡大、オープンモデルの追加の可能性
Anthropic、OpenAI、Google、Meta、Microsoft、MistralがEU AI透明性コードに署名
他 34 件
Evaluation & benchmarks
33 →
本番環境のエージェント型システム構築から得られた教訓
Muse-LtdがLLMの認識論的キャリブレーションのためのUncertaintyGymベンチマークを提出
ICML 2026 Open Reproductions チャレンジで、調査論文の23%に虚偽の主張があることが判明
他 30 件
Hardware & chips
21 →
アリババ、NVIDIA GB300 NVL72向けQwen3.8-2.4T-A95Bのオープンウェイトをリリース
RunSnack は単一リンク経由で P2P GPU 共有を可能にする
llama.cpp b10306がSYCL GLUフラットパスを追加し、カーネルを統合
他 18 件
Robotics
19 →
Strands AgentsがLeRobotとHugging Face Storage Bucketsを統合し、ロボットのデータループを継続化
Dyna Roboticsが、100万時間分の人間の動画で事前学習された世界行動モデル「Dyna-2」をリリース
Calibraがロボティクス学習データセットの問題を検出
他 16 件
Retrieval & RAG
16 →
VITAの臨床用RAGはHealthBenchにおいて最先端LLMと同等かそれ以上の性能を示す
Corpus固有のVITA RAGはHealthBenchで最先端LLMに匹敵または上回る
VITA臨床RAGシステムはHealthBenchで最先端LLMと同等またはそれ以上の性能
他 13 件
Video generation
15 →
HorizonRelightはマスクされた自己条件付けを使用して、長時間のビデオリライティングの一貫性を達成
LTXがローカル動画生成用のオープンウェイト・ワールドモデル「LTX-2.5」をリリース
MiniMaxが同期オーディオ付きのオープンウェイトH3ビデオモデルをリリース
他 12 件
Voice & audio
13 →
llama.cpp b10369がpocket-ttsサポートを追加し、CUDA生成が80%高速化
NVIDIA Magpie TTSがアラビア語、韓国語、ポルトガル語を追加し品質を向上
NVIDIAが約450msのターンテイクを備えたオープンなフルデュプレックス音声対話モデル「NemotronLabs VoiceChat 11B」をリリース
他 10 件
Image generation
13 →
Nvidia、ハイブリッドドメイン知識融合によるリアルタイムポートレート再照明手法「FusionRelight」を発表
GoogleがDiffusionGemmaの技術レポートを公開
xAIが正確な編集とレイアウト機能を備えたImagine Image 2.0をリリース
他 10 件