破题
等待近三个月后,DeepSeek V4 的「满血版」终于走到发布前夕。
据多方消息,DeepSeek V4 正式版(GA)最早将于明日(7月20日)开启灰度,最迟不过几日。部分用户已经提前拿到了测试权限。
这不是一次简单的版本迭代。V4 GA 的到来,带着三个值得行业仔细品味的变量:
- 两个版本分层:DeepSeek V4 Flash 和 DeepSeek V4 Pro
- 首次引入「峰谷计费」:那个从不涨价的「价格屠夫」装了计价器
- 生态位已经变了:Fable 5、GPT-5.6 Sol、Kimi K3 在前,V4 要靠什么牌打?
拆解:性能篇——Opus 级,但不是第一
早期灰度用户的反馈已经流出。开发者 Pankaj Kumar 在体验后给出了一个中肯的定位:
整体表现接近 Opus 4.8 级别,编码直追 GPT-5.6 Sol;Agent 能力大幅增强,3D 和 SVG 生成显著变好。
这个评价很关键——它说明 V4 正式版在「通用能力」上已经摸到了第一梯队的天花板,但单项上未必能夺冠。
一个有意思的「验货口诀」在开发者社区流传:看思维链(CoT)的第一人称。如果模型思考过程开口是「I'm」「I'll」而非老版本的「Let me」,那大概率已经用上了 V4 GA 版。
首轮流出 Demo 展示了 V4 Pro 的多方面能力:3D 模拟射击游戏、混合风格游戏 HTML、「割绳子」经典游戏的一次性生成、Xbox 手柄 SVG 测试。
不过,部分开发者指出 Pro 版并未比 Flash 版领先太多,这暗示着 DeepSeek 的策略更偏向「整体够用」而非「极致旗舰」。在长上下文检索、专业软件工程和部分知识推理评测中,Opus 仍保持领先。V4 预览版发布时,官方自测的 SWE-bench Verified 中,DeepSeek-V4-Pro-Max 距 Claude Opus 4.6 Max 仅差 0.2 个百分点。
推演:价格篇——装了计价器,但依然是最锋利的刀
真正值得关注的,是 DeepSeek 在定价策略上的首次「进化」。
上月底,DeepSeek 向所有 API 用户发出邮件,宣布 V4 正式版同步调整 API 定价,首次引入「峰谷计费」。
| 模型 | 情境 | 价格(百万 Tokens) |
|---|---|---|
| V4 Pro 输出(平时) | 普通时段 | $0.87 |
| V4 Pro 输出(高峰) | 高峰时段 | $1.74 |
| V4 Pro 输入(缓存未命中) | 普通时段 | $0.435 |
| V4 Flash 输出(平时) | 普通时段 | $0.28 |
| V4 Flash 输出(高峰) | 高峰时段 | $0.56 |
| V4 Flash 输入(缓存命中) | — | $0.0028 |
对比 Fable 5 的百万输出定价 $50,DeepSeek V4 Flash 的 $0.28 几乎是其 1/180。即便用 Pro 版 vs Fable 5,差距也是 57 倍。
在这里,核心逻辑不是「谁更强」,而是「谁够用又便宜」。
建框架:峰谷计费意味着什么?
峰谷计费这个变化,是理解 DeepSeek 战略转向的关键窗口。
这不是涨价,而是精细化。 以前 DeepSeek 的打法是「一个价打到死」,用极低价格换取市场份额。现在 V4 正式版引入了时段差异——缓存命中依然极低,但高峰时段的算力成本由高频用户分担。
对三类用户的影响截然不同:
- 个人开发者 / 偶尔调用者:几乎无感。非高峰时段调用,Flash 版 $0.28/M 输出,跟以前没区别。
- 长时间运行的 Agent 团队:需要重新算账。如果把 Agent 挂在工作时间不间断跑,高峰时段成本翻倍。
- 批量任务 / 数据生成 / 评测跑分:完全可以挪到高峰之外,利用缓存命中价格($0.0028/M 输入)把成本压回原来的水位。
这个设计很聪明——它实际上在引导用户做「算力调度」,把弹性负载移到非高峰时段,本质上是在为 DeepSeek 自己的算力集群做削峰填谷。
落到行动:我们应该做什么?
对于使用 DeepSeek 的团队和个人,有几个可以立即着手的点:
1. 灰度测试验证
- 如果用 API,检查 DeepSeek 控制台是否有灰度选项
- 用「CoT 第一人称」快速判断是否已接入 GA 版本
- 在 SWE-bench 类工程任务上评估新旧版本差异
2. 成本策略调整
- 批量任务排到非高峰时段(深夜/凌晨)
- 充分利用缓存命中——多次调用的相同前缀输入,成本近乎免费
- 对高峰时段有刚性需求的场景,评估 V4 Flash vs Pro 的性能差异是否值得价差
3. 模型迁移准备
- deepseek-chat 和 deepseek-reasoner 两个旧模型名将于 7月24日正式下线
- 确保代码中的模型名已更新到 v4 系列的正式名称
4. 生态位思考
V4 GA 的定位是:Opus 级能力,1/7 的价格。它不是最强的模型,但在「够用 × 便宜」这个象限里,它几乎无可匹敌。
对于 C 端产品集成、Agent 中台、批量推理场景,V4 可能比 Fable 5 和 GPT-5.6 Sol 更适合——不是因为更好,而是因为足够好还便宜一个数量级。
DeepSeek 从来不打「性能第一」这张牌。它打的是「把 Opus 级的能力价格打到七分之一」。在动辄百万 Token 几十美元的巨头面前,即使是装了「峰谷计价器」的 V4,也依然是那个大杀四方的价格屠夫。
