DeepSeek V4「满血版」明日内测:Opus级性能、七分之一价格,首启峰谷计费

破题

等待近三个月后,DeepSeek V4 的「满血版」终于走到发布前夕。

据多方消息,DeepSeek V4 正式版(GA)最早将于明日(7月20日)开启灰度,最迟不过几日。部分用户已经提前拿到了测试权限。

这不是一次简单的版本迭代。V4 GA 的到来,带着三个值得行业仔细品味的变量:

  • 两个版本分层:DeepSeek V4 Flash 和 DeepSeek V4 Pro
  • 首次引入「峰谷计费」:那个从不涨价的「价格屠夫」装了计价器
  • 生态位已经变了:Fable 5、GPT-5.6 Sol、Kimi K3 在前,V4 要靠什么牌打?

拆解:性能篇——Opus 级,但不是第一

早期灰度用户的反馈已经流出。开发者 Pankaj Kumar 在体验后给出了一个中肯的定位:

整体表现接近 Opus 4.8 级别,编码直追 GPT-5.6 Sol;Agent 能力大幅增强,3D 和 SVG 生成显著变好。

这个评价很关键——它说明 V4 正式版在「通用能力」上已经摸到了第一梯队的天花板,但单项上未必能夺冠。

一个有意思的「验货口诀」在开发者社区流传:看思维链(CoT)的第一人称。如果模型思考过程开口是「I'm」「I'll」而非老版本的「Let me」,那大概率已经用上了 V4 GA 版。

首轮流出 Demo 展示了 V4 Pro 的多方面能力:3D 模拟射击游戏、混合风格游戏 HTML、「割绳子」经典游戏的一次性生成、Xbox 手柄 SVG 测试。

不过,部分开发者指出 Pro 版并未比 Flash 版领先太多,这暗示着 DeepSeek 的策略更偏向「整体够用」而非「极致旗舰」。在长上下文检索、专业软件工程和部分知识推理评测中,Opus 仍保持领先。V4 预览版发布时,官方自测的 SWE-bench Verified 中,DeepSeek-V4-Pro-Max 距 Claude Opus 4.6 Max 仅差 0.2 个百分点。

推演:价格篇——装了计价器,但依然是最锋利的刀

真正值得关注的,是 DeepSeek 在定价策略上的首次「进化」。

上月底,DeepSeek 向所有 API 用户发出邮件,宣布 V4 正式版同步调整 API 定价,首次引入「峰谷计费」

模型情境价格(百万 Tokens)
V4 Pro 输出(平时)普通时段$0.87
V4 Pro 输出(高峰)高峰时段$1.74
V4 Pro 输入(缓存未命中)普通时段$0.435
V4 Flash 输出(平时)普通时段$0.28
V4 Flash 输出(高峰)高峰时段$0.56
V4 Flash 输入(缓存命中)$0.0028

对比 Fable 5 的百万输出定价 $50,DeepSeek V4 Flash 的 $0.28 几乎是其 1/180。即便用 Pro 版 vs Fable 5,差距也是 57 倍。

在这里,核心逻辑不是「谁更强」,而是「谁够用又便宜」。

建框架:峰谷计费意味着什么?

峰谷计费这个变化,是理解 DeepSeek 战略转向的关键窗口。

这不是涨价,而是精细化。 以前 DeepSeek 的打法是「一个价打到死」,用极低价格换取市场份额。现在 V4 正式版引入了时段差异——缓存命中依然极低,但高峰时段的算力成本由高频用户分担。

对三类用户的影响截然不同:

  1. 个人开发者 / 偶尔调用者:几乎无感。非高峰时段调用,Flash 版 $0.28/M 输出,跟以前没区别。
  2. 长时间运行的 Agent 团队:需要重新算账。如果把 Agent 挂在工作时间不间断跑,高峰时段成本翻倍。
  3. 批量任务 / 数据生成 / 评测跑分:完全可以挪到高峰之外,利用缓存命中价格($0.0028/M 输入)把成本压回原来的水位。

这个设计很聪明——它实际上在引导用户做「算力调度」,把弹性负载移到非高峰时段,本质上是在为 DeepSeek 自己的算力集群做削峰填谷。

落到行动:我们应该做什么?

对于使用 DeepSeek 的团队和个人,有几个可以立即着手的点:

1. 灰度测试验证

  • 如果用 API,检查 DeepSeek 控制台是否有灰度选项
  • 用「CoT 第一人称」快速判断是否已接入 GA 版本
  • 在 SWE-bench 类工程任务上评估新旧版本差异

2. 成本策略调整

  • 批量任务排到非高峰时段(深夜/凌晨)
  • 充分利用缓存命中——多次调用的相同前缀输入,成本近乎免费
  • 对高峰时段有刚性需求的场景,评估 V4 Flash vs Pro 的性能差异是否值得价差

3. 模型迁移准备

  • deepseek-chat 和 deepseek-reasoner 两个旧模型名将于 7月24日正式下线
  • 确保代码中的模型名已更新到 v4 系列的正式名称

4. 生态位思考

V4 GA 的定位是:Opus 级能力,1/7 的价格。它不是最强的模型,但在「够用 × 便宜」这个象限里,它几乎无可匹敌。

对于 C 端产品集成、Agent 中台、批量推理场景,V4 可能比 Fable 5 和 GPT-5.6 Sol 更适合——不是因为更好,而是因为足够好还便宜一个数量级


DeepSeek 从来不打「性能第一」这张牌。它打的是「把 Opus 级的能力价格打到七分之一」。在动辄百万 Token 几十美元的巨头面前,即使是装了「峰谷计价器」的 V4,也依然是那个大杀四方的价格屠夫。

滚动至顶部