DeepSeek目前正在训练一个拥有2万亿参数的新模型,并计划最终构建一个8万亿参数的模型。
- 当前的DeepSeek Flash拥有5520亿参数。
- DeepSeek Pro共有1.6万亿参数,每个token激活490亿权重。
- Mythos / Fable模型的参数量估计为10万亿。
DeepSeek目前正在训练一个拥有2万亿参数的新模型,并计划最终构建一个8万亿参数的模型。
中国监管机构正在调查DeepSeek和Moonshot AI是否可能向美国公司Anthropic泄露数据。此次调查源于有关Kimi高管的传闻,但目前的情况被描述为调查而非已确认的逮捕。
研究人员介绍了 CodeMidas,这是一种智能体管道,它使用源代码作为唯一输入,从开源代码库中实现的功能构建强化学习环境。 该方法分配智能体计算资源以探索功能、构建基于执行的测试,并通过重复 rollout 验证任务,最终生成涵盖 23 种编程语言的 5,545 个训练任务数据集。 在 GRPO 的帮助下在这些任务上训练 MiMo-V2.5,在五个多样化的基准测试中提升了性能,包括 DeepSWE (+11.7%)、ProgramBench (+17%) 和 Terminal-Bench v2.1 (+8.5%)。 轨迹分析表明,经过 RL 训练的代理表现出更好的行为,例如更深入的代码库探索和更多样化的自我验证。 这些结果确立了源代码作为构建强化学习环境的可扩展基础,能够提升编码智能体在多样化软件任务中的表现。
DeepSeek发布了DeepSeek-V4.1-Flash,这是一种多模态混合专家(MoE)模型,旨在解决智能体工作负载中长上下文计算和高KV缓存带来的高昂成本。
Atria Dawn Preview 是一个面向科学研究和工程工作流的基础代理语言模型,通过可验证经验管道进行训练,该管道将工具中介交互与可执行环境相连接。在涵盖真实世界研究、工程和数字工作的16个基准测试中,该模型的表现可与前沿代理相媲美,并在其中五个基准上取得了最高报告分数。
DeepSeek V4.1 Flash 在 Artificial Analysis Intelligence Index v4.3 更新中,于新的 Astra 基准测试中夺得第一名。
我们使用 Cookie 来统计访问量并改进网站。您可以接受或拒绝分析 Cookie。 隐私政策