DeepSeek V4-Flash正式版上线:Agent能力暴涨、价格再降
7月31日,DeepSeek放了个大招——V4-Flash正式版(模型名 deepseek-v4-flash)API 正式开启公测。这次升级跟以往的版本更新不太一样:模型架构和参数规模完全没变,只重新做了后训练,但效果出乎意料地好。
核心变化:Agent能力暴涨
V4-Flash正式版最亮眼的变化是Agent能力。根据官方公布的测试数据:
- Agent智能体终极测试得分:从预览版的15.8直接飙升至64.5
- Agent能力提升幅度超过4倍,在同参数规模模型中表现极为突出
- 模型总参数约2840亿,激活参数约130亿,MoE架构与预览版一致
这意味着什么?简单说,V4-Flash正式版在工具调用、多步推理、代码执行等Agent场景的综合能力有了质的飞跃。对于开发者来说,这意味着可以用更低的成本实现更复杂的自动化流程。
价格:继续做"价格屠夫"
DeepSeek这次的价格策略依然很激进:
- 缓存命中后输入成本:0.02元/百万tokens
- 100万token上下文窗口,最大输出可达38.4万token
- 在同级别模型中性价比极高
这个价格配合Agent能力的提升,让V4-Flash在开发、内容创作、轻量级Agent等场景中非常有竞争力。
生态整合:Codex接入与Harness即将公布
除了模型本身,这次公布还有两个值得关注的信息:
- OpenAI Codex接入:OpenAI开源的Codex现在可以接入deepseek-v4-flash了。deepseek-v4-pro预计2026年8月初也支持接入Codex。这意味着开发者可以在Codex生态中使用DeepSeek的模型。
- DeepSeek Harness即将公布:DeepSeek官宣Harness工具即将发布,具体功能和发布时间待官方进一步公布。
对开发者的影响
V4-Flash正式版的发布,对开发者来说有几个实实在在的好处:
- Agent开发成本大幅降低:更强的Agent能力 + 更低的价格,适合做高频调用的自动化任务
- Codex生态兼容:可以复用Codex的工具链和开发流程
- 长上下文支持:100万token窗口适合处理大规模代码库和文档
如果你之前因为预览版的Agent能力不够强而犹豫,现在可以重新评估了。正式版的Agent能力提升是实打实的,配合极具竞争力的价格,是目前性价比最高的选择之一。
据DeepSeek官方公告及多家媒体报道整理。V4-Flash正式版API目前为公测阶段,具体价格和可用性以官方文档为准。