DeepSeek-V4-Flash 的官方版本现已在 DeepSeek API 上线。
此次更新使开发者可以通过平台的编程接口访问该新模型。
DeepSeek-V4-Flash 的官方版本现已在 DeepSeek API 上线。
此次更新使开发者可以通过平台的编程接口访问该新模型。
DeepSeek已更新其DeepSeek-V4-Flash模型,并宣布DeepSeek-V4-Pro的官方发布将紧随其后。
Reddit 上的讨论表明,在初步预览阶段之后,DeepSeek v4 flash 发布版可能已在 API 上激活。这一时间点与计划于 7 月中旬开放权重的安排相符。
DeepSeek发布了DeepSeek-V3,这是一款强大的混合专家(MoE)语言模型,总参数量为671B,每个token激活37B。该模型采用多头潜在注意力机制和无辅助损失负载均衡策略,使用FP8混合精度在14.8万亿个token上进行训练。
新的DeepSeek V4-Flash模型在ArtificialAnalysis指数中获得了50分的成绩。这一成绩使其仅比GLM-5.2和GPT-5.6 Luna低一分。
DeepSeek-V4-Flash-0731 模型在保持与前任相同定价的同时,性能优于 GLM 5.2。