ラボ · DeepSeek
lab DeepSeek API Docs · 21日前 Codeforces (Elo) · 3471.0Elo · 68 回表示

DeepSeekがネイティブマルチモーダルサポートを備えたV4.1-Flashモデルをリリース

DeepSeekは、新しいアーキテクチャファミリーの最小メンバーであり、ネイティブなマルチモーダル視覚理解機能を備えたDeepSeek-V4.1-Flashモデルを正式にリリースしました。この新しいアーキテクチャは、より高い能力の上限、より高速な推論速度、より高いスループット、および大規模モデルのためのより良いスケーリングの可能性を提供するように設計されています。

media AI News (smol.ai) · 18日前 · 51 回表示

DeepSeekが極限の推論効率に焦点を当てたオープンウェイトモデルV4.1-Flashをリリース

DeepSeekは、極限の推論効率と低コストを実現するために設計された新しいオープンウェイトのフラッグシップモデルであるV4.1-Flashをリリースしました。このモデルは、アクティブな計算量とKV/キャッシュのコストを大幅に削減するために、因果的なエンコーダ・デコーダアーキテクチャを利用しています。

media MarkTechPost · 20日前 · 55 回表示

DeepSeekが1MコンテキストとFP4 KVキャッシュを搭載したDeepSeek-V4.1-Flashをリリース

DeepSeek AIは、100万トークンのコンテキストウィンドウと、グローバルキャッシュのフットプリントをトークンあたり890バイトに削減するFP4 KVキャッシュを備えたマルチモーダルMixture-of-ExpertsモデルであるDeepSeek-V4.1-Flashをリリースしました。このモデルは、因果的なエンコーダ・デコーダアーキテクチャとCompressed Sparse Attention 2 (CSA2) を活用し、パフォーマンスを維持しながらメモリ要件を大幅に削減しています。

arxiv arXiv cs.AI · 10日前 · 24 回表示

CodeMidasはソースコードを使用してエージェント型コーディングRL環境をスケーリング

研究者らは、オープンソースのコードベースに実装された機能を用いて、ソースコードを唯一の入力として強化学習環境を構築するエージェントパイプライン「CodeMidas」を紹介した。 本手法は、エージェント計算資源を割り当てて機能を探索し、実行に根ざしたテストを構築し、反復ロールアウトを通じてタスクを検証することで、23のプログラミング言語にわたる5,545件のトレーニングデータセットを生成する。 これらのタスクでGRPOを用いてMiMo-V2.5を訓練すると、DeepSWE (+11.7%)、ProgramBench (+17%)、Terminal-Bench v2.1 (+8.5%) など5つの多様なベンチマークでパフォーマンスが向上した。 軌跡分析により、RLで訓練されたエージェントは、コードベースの探索増加やより多様な自己検証など、より優れた行動を示すことが示唆された。 これらの結果は、多様なソフトウェアタスクにおけるコーディングエージェントを改善するRL環境を構築するためのスケーラブルな基盤として、ソースコードを確立するものである。

arxiv arXiv cs.AI · 15日前 · 27 回表示

Atria Dawn プレビュー: 科学的研究のための基盤エージェント型言語モデル

Atria Dawn Preview は、科学的研究およびエンジニアリングワークフローのために設計された基盤エージェント型言語モデルであり、ツールを介した相互作用を実行可能環境に接続する検証可能な経験パイプラインを通じてトレーニングされています。現実の研究、エンジニアリング、デジタル作業にわたる16のベンチマークにおいて、このモデルは最先端のエージェントと競争力があり、そのうち5つで最高の報告スコアを達成しています。

media r/LocalLLaMA · 21日前 · 56 回表示

DeepSeekが低コスト・高速化を実現する552B MoEモデル「V4.1 Flash」をリリース

DeepSeekは、ネイティブなマルチモーダル視覚理解機能を備えた新アーキテクチャシリーズの最小型モデルであるDeepSeek V4.1 Flashを正式にリリースした。因果的エンコーダ・デコーダ設計に基づき、入力側で8Bパラメータ、出力側で16Bパラメータのみを活性化させる552BパラメータのMixture of Experts (MoE)モデルである。