等待三个月,"满血版"终于来了
三天前的WAIC 2026上,Kimi K3在模型侧搅动风云,Fable 5与GPT-5.6 Sol持续角力的格局下,一个沉寂了近三个月的名字终于浮出水面——DeepSeek V4正式版,开始了灰度测试。
根据多家媒体的信息,DeepSeek V4(GA)最早可能在7月19日至20日间正式发布。目前,部分开发者已提前拿到了灰度测试的权限,首轮Demo也开始外流。
整编下来,这大概是DeepSeek目前最具"策略性"的一次发布:不是单纯堆参数、也不是单纯压价格,而是两者兼有,外加一个让行业侧目的定价新机制。
双版本策略:Flash主打性价比,Pro对标Opus级
这次V4正式版有两个版本:
- DeepSeek V4 Flash:主打极致性价比,百万输出tokens定价0.28美元,高峰时段0.56美元
- DeepSeek V4 Pro:对标Opus 4.8级别,编码能力逼近GPT-5.6 Sol,百万输出tokens平时0.87美元,高峰1.74美元
开发者Pankaj Kumar率先对V4的性能做了总结:
整体表现接近Opus 4.8级别,编码直追GPT-5.6 Sol;Agent能力大幅增强,3D和SVG生成显著变好。
他还指出一个值得注意的差异:同样的任务,V4所需的迭代轮数比Fable 5多。这意味着V4在单次推理质量上可能不是最优,但其定价优势足以让用户在使用成本上"以量换价"。
外界对首轮测试的结果褒贬不一。有人认为V4已经能打平Claude 5,但部分开发者指出Pro版并未比Flash版领先太多。这或许也是DeepSeek有意为之——让Flash成为走量主力,Pro负责守住高端战场的底线。
峰谷计费:DeepSeek的定价转身
这次的定价策略里,比性能更值得关注的是"峰谷计费"。
DeepSeek上月底向所有API用户发送邮件,称V4正式版发布后将同步调整API定价,首次引入峰谷计费机制:
| 模型 | 百万输出tokens(平时) | 百万输出tokens(高峰) |
|---|---|---|
| deepseek-v4-pro | $0.87 | $1.74 |
| deepseek-v4-flash | $0.28 | $0.56 |
缓存命中后的输入价格更是低至$0.0028/百万tokens。
这是那个从不让步、从不涨价的"价格屠夫"第一次给算力装上了计价器。
为什么现在做这件事?三个原因:
- 推理量级暴涨:黄仁勋反复强调推理算力将增长一万倍。当Token从稀罕物变成日常消费品,简单的统一定价在大规模调用场景下变得不可持续。
- 负载均衡需求:工作日白天是Agent持续调用的高峰期,深夜和周末是低谷。峰谷计价可以用价格信号引导开发者错峰调用,降低DeepSeek自己的算力峰值压力。
- 不涨价但优化定价结构:对比Fable 5百万输出定价$50、GPT-5.6 Sol的更高定价,V4即使在高峰时段也仅是竞品的零头。峰谷计费不等于涨价,而是把定价从"一刀切"变成"弹性区间"。
对个人用户,影响微乎其微。但对那些把Agent挂在工作时间不间断跑的团队来说,这是一笔要重新算的账——好在缓存命中价格极低,将批量评测、数据生成任务挪到低谷时段,成本还能压回去。
生态位:不做第一,只做最香的
V4正式版发布的时机耐人寻味。
前有Fable 5与GPT-5.6 Sol的顶端对决,左侧有Kimi K3刚在WAIC上亮相。DeepSeek V4夹在其中,靠纯性能"掀桌子"难度不小。
但DeepSeek从来打的就不是这张牌。
V4预览版发布时,DeepSeek-V4-Pro-Max在SWE-bench Verified上距Claude Opus 4.6 Max仅差0.2个百分点,价格却只有对方的七分之一。这个叙事逻辑延续到了正式版:Opus级能力,七分之一的价格——即便装上了峰谷计价器,V4依然是性价比之选。
对开发者而言,生态位很清晰:
- 要做高精度推理、复杂Agent → V4 Pro
- 要批量调用、成本敏感 → V4 Flash + 错峰策略
- 零成本试用缓存命中 → 缓存命中输入仅$0.0028/百万tokens
还有一个信号值得注意:deepseek-chat和deepseek-reasoner两个老模型名,将在7月24日正式下线。这意味着DeepSeek正在全面切换至V4系列,不是渐进式升级,而是果断的换代。
对开发者的实际建议
- 重算成本结构:如果团队正在大规模使用API,需要评估工作日峰值调用占比,合理分配批量任务到低谷时段
- 调整迭代策略:V4需要更多轮次才能达到Fable 5的单轮质量,但总成本可能更低。在Agent场景中,是"一次贵但准"还是"多次便宜"?需要实测验证
- 重新评估Agent构建:V4 Agent能力大幅增强,3D/SVG生成显著变好,对于想要在应用层构建差异化体验的团队,这是一个值得重新评估的模型
- 抓住迁移窗口:V4正式版即将发布,老模型即将下线,建议在7月24日前完成迁移测试
毕竟,在动辄百万Token几十美元的巨头面前,那个装上了峰谷计价器的DeepSeek,依然是降本增效路上最香的选项。
