DeepSeek V4.1-Flash 发布与改名:deepseek-flash 与 V4 Pro 下线
9月10日,DeepSeek 官方发布公告,正式推出 DeepSeek-V4.1-Flash。这次不只是多一个模型那么简单——它带来了模型体系的一次重构:新的模型名 deepseek-flash、旧模型名的兼容路由,以及 V4 Pro 的"承上启下"式的下线安排。如果你正在用 DeepSeek 的 API,这篇值得看完,尤其是涉及改代码和预算的部分。
V4.1-Flash 是什么
根据官方发布说明,V4.1-Flash 是 DeepSeek 全新模型结构系列中尺寸最小的模型,原生支持多模态视觉理解。官方给这个新结构系列定的设计目标是:能力上限更高、推理速度更快、吞吐更大,并且可扩展到更大的参数模型。
这解释了为什么它叫 V4.1 而不是带后缀的新名字——它是新架构的起点,后续应该还有更大的型号。
官方公布的部分评测成绩(来自 DeepSeek API 更新日志):
| 基准测试 | V4.1-Flash |
|---|---|
| GPQA Diamond | 90.9 |
| HLE | 36.8 (纯文本子集 39.1*) |
| Codeforces (Rating) | 3471 |
| Terminal-Bench 2.1 | 90.6 |
| DeepSWE v1.1 | 74.2 |
| CyberGym | 88.1 |
| Agents' Last Exam | 31.8 |
| Chartography (w/tools) | 78.9 |
*表示仅在 HLE 纯文本子集上测试。
其中 Terminal-Bench 2.1 达到 90.6、Codeforces 评分 3471,说明代码和终端场景对 V4.1-Flash 来说是真强项。GPQA Diamond 90.9 属于旗舰级的表现水平了,作为最小尺寸模型能有这个数据确实有些出乎意料。
改名与兼容路由:代码里怎么写
V4.1-Flash 上线后,DeepSeek 把 API 的模型名改成了 deepseek-flash。这是这次改动里最容易踩坑的一点——如果你代码里写的是旧名字,务必往下看。
官方 API 变更说明:
- 新模型通过
model="deepseek-flash"调用 - 旧版
deepseek-v4-flash已下线 - 旧版视觉模型
deepseek-v4-flash-vision-exp已下线 - 出于兼容考虑,
deepseek-v4-flash和deepseek-v4-flash-vision-exp这两个旧模型名会被暂时路由到 V4.1-Flash
也就是说,如果你暂时不想改代码,旧名字短期还能用(路由到新模型),但官方已经明确这是临时的。尽早把代码里的模型名改成 deepseek-flash 才是正道,避免某天路由被移除后请求直接报错。
如果你的调用里用的是 deepseek-v4-pro,也要注意——见下一节。
调用示例(OpenAI 兼容格式):
```python import openai
client = openai.OpenAI( api_key="your-deepseek-api-key", base_url="https://api.deepseek.com" )
response = client.chat.completions.create( model="deepseek-flash", messages=[{"role": "user", "content": "用 DeepSeek 给我写一段快速排序"}] )
print(response.choices[0].message.content) ```
V4 Pro 下线:9月14日后的行为变化
这次公告里最重要的一条,是 V4 Pro 的下线安排:
经多方测试,V4.1 Flash 在性能、费用、速度、总用时等指标上已全面超越 DeepSeek V4 Pro。平台计划有序下线 V4 Pro 模型。北京时间 2026 年 9 月 14 日 12:00 之后,至未来 V4.1 Pro 上线之前,访问
deepseek-v4-pro的请求将全部路由到 V4.1 Flash,并按 V4.1 Flash 的单价计费。
翻译成人话:
- 9月14日中午12点(北京时间) 是个关键节点
- 之后你写
deepseek-v4-pro,请求不会报错,但会悄悄跑到 Flash 上 - 计费按 Flash 的价格来,比 Pro 便宜——这是好消息,但要小心性能差异:原本跑 Pro 的复杂任务,路由到 Flash 后输出风格和质量可能会变
- 等到 V4.1 Pro 上线,才会有一个新的 Pro 级模型
给你的建议:如果你的项目显式指定了 deepseek-v4-pro,在 9月14日前想清楚迁移策略。虽然官方说 Flash 已全面超越 Pro,但对你的具体任务是不是真的如此,最好自己 benchmark 验证一下,别直接信。
API 价格变化
随着 V4.1-Flash 上线,API 价格也做了调整。以当前官方定价页显示的 V4-Flash 价格为例(单位为元/百万 tokens):
| 计费项 | deepseek-v4-flash | deepseek-v4-pro |
|---|---|---|
| 输入(缓存命中) | 0.02 | 0.025 |
| 输入(缓存未命中) | 1 | 3 |
| 输出 | 2 | 6 |
注意:这个差异是结构性的——V4-Flash 的输入未命中和输出价格分别是 V4 Pro 的约三分之一。如果你原先用 Pro 做高吞吐、长上下文的任务,9月14日后切到 Flash 计费,成本下降会非常可观。具体到每个任务的成本测算,建议以官方实时定价页为准,价格可能调整。
一句话总结
V4.1-Flash 的发布本质是一次"模型体系升级 + API 规范化":新架构起点、统一模型名 deepseek-flash、旧视觉模型下线、V4 Pro 过渡下线。对开发者来说,最需要动手的两件事是——尽快把模型名改成 deepseek-flash,以及为 9月14日的 Pro→Flash 路由做好准备。
据 DeepSeek 官方 API 更新日志与模型定价页整理。价格与模型可用性以官方最新文档为准。