- 类型
- 模型
- 来源
- AIHOT · X / 公众号精选
- 发布
- 2026年7月31日 21:38
- 状态
- 多源确认
发生了什么
DeepSeek 于 2026 年 7 月 31 日发布开源模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上得分 50,位列开源模型前三。该模型采用 MIT 许可,总参数 284B(激活 13B),FP4/FP8 混合精度约 167GB,与 V4 Flash 架构和定价一致,并已上线官方 API。Product Hunt 上以“Flash 价格的边缘代理智能”为宣传语介绍该模型。
为什么重要
这是 DeepSeek 在开源模型领域的一次重要进展,模型性能进入开源前三,且采用 MIT 许可,降低了使用门槛。对于依赖开源模型的产品团队而言,多了一个高性能、低激活参数的选择,可能影响模型选型和成本结构。
底层逻辑
DeepSeek V4 Flash 0731 采用总参数 284B、激活参数 13B 的 MoE 架构,结合 FP4/FP8 混合精度,使模型体积约 167GB,在保持性能的同时降低推理成本。MIT 许可允许自由商用,模型定价与 V4 Flash 一致,官方 API 已上线,便于开发者和企业直接集成。
产品与商业机会
该模型开源且 API 可用,产品团队可低成本接入高性能模型,尤其适合对延迟和成本敏感的 agent 类产品。需评估模型大小与部署资源,但激活参数仅 13B,推测推理效率较高。MIT 许可免除授权顾虑,可加速产品集成。
- 将 DeepSeek V4 Flash 0731 作为 agent 产品的默认推理模型,利用其低激活参数降低单次调用成本。
- 基于 MIT 许可,将其私有化部署于对数据合规要求高的内部场景,替代部分闭源 API。
- 对比现有模型在典型任务上的性能与成本,决定是否切换或增加该模型作为备选供应商。
仍待确认
- 证据未提供该模型在特定基准(如 MMLU、HumanEval)上的详细表现,性能优势的具体范围待确认。
- 证据未说明官方 API 的定价细则,与 V4 Flash 的定价一致性需进一步核实。
- DeepSeek V4 Flash 0731 与 V4 Flash 的具体差异(如训练数据、微调方式)未被披露。