导语
2026年7月31日,DeepSeek 正式发布了 DeepSeek-V4-Flash(内部版本号 0731)的公测版本。这款模型没有改动任何架构,仅靠后训练(post-training)优化,就在多个智能体与编程基准上超越了自家更大规模的旗舰预览版,同时延续了 DeepSeek 一贯的”地板价”策略——缓存命中的 API 价格低至每百万 token 约 0.0028 美元。
事件详情:小模型,大能量
DeepSeek-V4-Flash-0731 的关键参数如下:
- 架构:混合专家(MoE)架构,总参数 2840 亿,每 token 仅激活约 130 亿参数;
- 上下文:原生支持 100 万 token 上下文窗口;
- 开源协议:MIT 协议,权重已在 Hugging Face 公开发布(约 167GB,分 48 个分片);
- 性能:官方模型卡显示,其在 Terminal Bench 2.1 上得分 82.7,大幅高于预览版的 61.8,甚至超过了参数规模大得多的 V4-Pro 预览版(72.1);独立评测机构 Artificial Analysis 也将其智能指数从 40 上调至 50;
- 价格:API 定价为每百万输入 token 0.14 美元、输出 0.28 美元,缓存命中仅 0.0028 美元——约为 Claude Opus 4.8 级别模型价格的九十分之一。
背景分析:”重新训练”路线的胜利
这次发布最耐人寻味的一点是:V4-Flash-0731 与 4 月发布的预览版是同一套架构,性能跃升完全来自后训练阶段的优化。这在开发者社区引发了热烈讨论——在”堆参数、改架构”成为主流叙事的今天,DeepSeek 用事实证明,精细的后训练同样能带来代际级的性能提升。
这背后是 DeepSeek 独特的工程哲学:把训练效率做到极致,再把成本红利用价格战的方式返还给市场。从 V3 到 R1 再到 V4,DeepSeek 的每一次发布都在做同一件事——用更低的成本逼近甚至超越闭源旗舰模型的性能,迫使整个行业重新定价。
为什么是”智能体主力”?
智能体(Agent)应用的特点是高频、多轮、长链条调用,对 token 成本极度敏感。V4-Flash 的超低价格让”递归循环、多智能体协作”这类此前烧不起的架构变得经济可行。社区已将其称为新一代”agent workhorse”(智能体主力机),这正是 DeepSeek 想要的生态位。
影响展望
对开发者而言,V4-Flash-0731 提供了一个极具吸引力的选项:接近旗舰的编码与智能体能力,MIT 协议可商用,价格低到可以忽略不计。它很可能成为 2026 年下半年中小团队构建 AI 应用的默认底座之一。
对行业而言,DeepSeek 再次扮演了”价格破坏者”的角色。当开源模型以 1% 的价格提供 90% 的能力时,闭源 API 的溢价空间将被持续压缩。值得注意的是,DeepSeek 随后在8月中旬上调了 API 价格并引入峰谷分时计价——这说明”地板价”更多是抢占生态的阶段性策略,而非永恒承诺。真正的考验在于:当价格回归理性后,DeepSeek 的技术领先性能否持续。