DeepSeek推出了DeepSeek v4.1-Flash,这是一款全新的开源权重旗舰模型,采用了新型因果编码器-解码器架构,旨在最大化推理效率并降低成本。
该模型利用具有7630亿总参数的混合专家结构,但仅激活8B参数用于输入处理,16B参数用于输出生成。这种设计实现了1-2%的稀疏度,并将KV缓存占用减少到前代V4 Flash模型的八分之一。它在MIT许可证下支持1M token上下文窗口,可处理文本和图像输入。
Artificial Analysis和Vals的独立基准测试将v4.1-Flash评为顶级开源权重模型,称其具有卓越的性价比,定价为每百万个输入token 0.30美元。