AI 快讯 | DeepSeek V4-Pro 今日正式退役:Flash 淘汰 Pro 的行业里程碑落地
一句话核心:北京时间 9/14 12:00 起,DeepSeek V4-Pro 所有请求正式路由到 V4.1 Flash 并按 Flash 价计费——「Flash 模型反向淘汰 Pro 旗舰」成为现实。开发零迁移即可享受性能更强、价格低 70%+ 的升级。
发生了什么
四天前,DeepSeek 发布 V4.1 Flash 时宣布:经过多方测试,V4.1 Flash 在性能、成本、速度、总耗时四个维度全面超越 V4-Pro,9/14 起 deepseek-v4-pro 请求全部路由到 V4.1 Flash。
今天,这件事正式落地了。
我在 V4.1 Flash 发布时写过:架构和价格是硬事实,但 benchmark「全面超越」的结论需第三方独立验证后才坐实。四天过去了,DeepSeek 没有撤回这个判断,而是按时执行了退役——这说明官方对 V4.1 Flash 的可靠性有足够信心。
对还在用 V4-Pro 的开发者意味着什么
| 计费项 | V4-Pro (Peak) | V4.1 Flash (Peak) | 降幅 |
|---|---|---|---|
| 输入 Cache Miss | $1.32 / M | $0.3 / M | ~77% |
| 输出 | $3.96 / M | $1.2 / M | ~70% |
不需要改一行代码,不需要切换模型名。
deepseek-v4-pro继续有效,但后端已经是 V4.1 Flash,价格也自动切到 Flash 的定价——这是一个「零迁移」的性能+价格双重升级。
旧模型名过渡指南
deepseek-v4-pro→ 今日起路由到 V4.1 Flashdeepseek-v4-flash、deepseek-v4-flash-vision-exp→ 已退役,临时路由到 V4.1 Flash- 新项目直接使用
deepseek-flash(官方推荐模型名)
这意味着什么
「Flash 淘汰 Pro」在 AI 行业极为罕见——通常 Pro 级模型需要被下一代的 Pro 替代,而不是被同一代的 Flash 超越。这次事件的核心意义:
- 新架构的跨越式提升被证实:Causal Encoder-Decoder + KV Cache 压缩不是 PR 话术,而是能在实际部署中把 552B 的 Flash 模型推到超越上一代 Pro 的水平
- 「参数规模 ≠ 性能等级」 的逻辑正在打破:552B MoE 通过更聪明的架构和训练,比前代更大参数量的 Pro 模型表现更好
- 未来的悬念在 V4.1 Pro:如果 Flash 已经超越 V4-Pro,那 V4.1 Pro 会是什么水平?DeepSeek 官方已预告「直到 V4.1 Pro 发布」,这个悬念值得关注
来源链接
- DeepSeek V4.1 Flash 官方公告:DeepSeek-V4.1-Flash: Smarter, Faster, More Efficient | DeepSeek API Docs
- 官方定价页:Models & Pricing | DeepSeek API Docs
- 论坛前期文章:https://bbs.jimu.chat/t/topic/102(V4.1 Flash 发布时的深度解读)
