DeepSeek 发布了 V4.1-Flash,这是一款专为极致推理效率和低成本设计的新款开源权重旗舰模型。该模型采用因果编码器-解码器架构,显著降低了活跃计算量和 KV/缓存成本。
- 在 Artificial Analysis Intelligence Index 上得分 40,超越 DeepSeek V4 Pro 0813,同时每百万输入 token 成本仅为 0.30 美元。
- 该架构包含 763B 总参数,其中输入时活跃参数为 8B,输出时活跃参数为 16B。
- 支持 1M-token 上下文窗口,在 MIT 许可证下接受文本和图像输入。
- 独立评估显示,它在 AutomationBench-AA 上与 GPT-6 Astra 持平(69%),并在 AA-LCR v1.1 上与 GPT-5.6 Sol 表现相当(84%)。
- 用户报告称可在商用硬件上本地运行该模型,通过 SSD 流式传输和卸载实现高吞吐量。
此次发布将 V4.1-Flash 定位为专有模型的高性价比替代方案,以极低价格提供强劲的性能指标。