等了近三个月,DeepSeek V4 正式版终于要来了。
据新智元报道,DeepSeek V4(GA)灰度测试权限已经向部分用户开放,最快于7月21日正式发布。本次发布包含两个版本:DeepSeek V4 Flash 和 DeepSeek V4 Pro。
这意味着,在 GPT-5.6 Sol、Fable 5 和 Kimi K3 相继登场的当下,开源阵营终于亮出了自己的底牌。
一、性能:不是「全项第一」,但足够能打
从已流出的灰度测试反馈来看,V4 的性能定位已经清晰:
- 整体水平接近 Opus 4.8,编码能力直追 GPT-5.6 Sol
- Agent 能力大幅增强,3D 和 SVG 生成显著改善
- 迭代轮数偏多:同样任务比 Fable 5 需要更多轮次
开发者 Pankaj Kumar 的总结比较中肯:从生态位来看,V4 大概率打不过刚发布的 Kimi K3,但价格会显著更低。
在 SWE-bench Verified 评测中,DeepSeek-V4-Pro-Max 距 Claude Opus 4.6 Max 仅差 0.2 个百分点,但价格只有后者的七分之一。不过在长上下文检索、专业软件工程和部分知识推理评测中,Opus 仍保持领先。
一个有趣的细节是灰度「验货口诀」:如果模型思考过程的 CoT 开口是「I'm」「I'll」而非旧版的「Let me」,那你大概率已经用上了 V4 GA 版。这种第一人称的变化,暗示着模型推理方式的底层重构。
二、定价:首次引入「峰谷计费」,价格屠夫装上计价器
真正的重头戏在定价策略上。
上月底,DeepSeek 向所有 API 用户发送邮件,预告 V4 正式版将在 7 月中旬上线,同时调整 API 定价,首次引入「峰谷计费」:
- DeepSeek V4 Pro:百万输出 tokens 平时 0.87 美元,高峰 1.74 美元;缓存未命中输入平时 0.435 美元
- DeepSeek V4 Flash:百万输出 0.28 美元,高峰 0.56 美元;缓存命中输入仅 0.0028 美元
对比之下,Fable 5 的百万输出定价为 50 美元。即使装上峰谷计价器,V4 在性价比上依然是碾压级的存在。
这个定价策略释放了两个信号:
第一,DeepSeek 开始正视算力成本结构。 此前一贯不涨价的「价格屠夫」,第一次给算力装上了计价器。对个人用户影响不大,但对那些将 Agent 挂在工作时间不间断运行的团队来说,这是实打实需要重新计算的成本。
第二,缓存命中的极致低价(0.0028 美元/百万 Token) 暗示 DeepSeek 在引导用户优化使用模式:将批量任务、评测跑分、数据生成挪到高峰之外,成本还能进一步压缩。
三、框架:DeepSeek 的生态位战略
V4 大概率不会是「全项第一」的模型。Fable 5 和 GPT-5.6 Sol 在高端性能上守擂,Kimi K3 在侧翼突击,V4 想靠纯性能掀桌子,难度不小。
但 DeepSeek 从来不打这张牌。
这家公司的核心策略是一条被反复验证的老路径:把 Opus 级的能力,价格压到七分之一。这不只是价格战,而是生态位竞争——在性能足够用的前提下,用性价比打开更广阔的应用层市场。
回顾 DeepSeek 的发展历程:
- DeepSeek V2:以 MoE 架构证明性价比模型可行
- DeepSeek V3 / R1:以推理能力出圈,引爆「DeepSeek 时刻」
- DeepSeek V4:从「技术突破」转向「商业化落地」,引入峰谷计费
这条路径的本质是:当模型能力达到 Opus 级别,竞争焦点从「谁更强」转向「谁更便宜、更可靠、更适合规模化部署」。DeepSeek 正在完成从实验室明星到商业基础设施的转型。
四、推演:对 AI 应用层的影响
V4 正式版的发布,对 AI 应用开发者意味着几件事:
1. Agent 的商业化成本门槛进一步降低。 百万输出 0.28 美元起的价格,让 Agent 的 token 成本不再是主要瓶颈。之前因为推理成本不敢上线的复杂 Agent 链路,现在可以重新评估。
2. 峰谷计费催生「使用模式优化」。 团队需要建立成本意识——不是所有任务都适合在高峰期跑。批量任务、自动化评测、数据生成可以规划到低谷时段,这是一种新的工程实践。
3. 开源模型的竞争力在「可用性」而非「基准分」。 V4 的灰度反馈显示,性能不是最高,但「够用+便宜」的组合对大多数应用场景已经足够。这也意味着,AI 应用层的竞争将更多围绕产品体验和业务场景展开,而非等待模型能力突破。
五、行动建议
如果你是 AI 应用开发者或团队技术负责人:
- 灰度测试期间尽快接入 V4,评估在你业务场景下的实际表现,而非只看基准分数
- 重新核算 Agent 的 token 成本,特别是对高并发、长链路的 Agent 场景
- 建立缓存策略,充分利用缓存命中的极致低价(0.0028 美元),将批量任务错峰执行
- 关注 7 月 24 日:deepseek-chat 和 deepseek-reasoner 两个老模型名将正式下线,需要提前迁移
顺带一提,DeepSeek 的估值近期因一则箱包公司的公告意外曝光,侧面印证了市场对其商业价值的认可。但 V4 的定价策略才是更值得关注的信号——它告诉我们,DeepSeek 正在从「技术明星」走向「商业基础设施」,而这条路,才是 AI 行业真正意义上的「DeepSeek 时刻」。
参考资料:
- 新智元报道(智源社区)
- Pankaj Kumar 灰度测试反馈
- DeepSeek API 用户邮件公告
