DeepSeek V4 Pro 正式版发布:Opus 级能力,1/7 价格,但这次悄悄装了个计价器

全网等了快三个月的"靴子",终于落地了:DeepSeek V4 Pro 正式版(0813)发布。

这可能是 2026 年开源 AI 最重要的一天。但和往常不一样,这次的热闹里藏着一个信号:那个从不涨价的"价格屠夫",第一次给自己的算力装上了计价器。

先搞清楚:V4 到底是个什么家族

很多人被"V4"搞晕了,其实它是一个家族,不是单打独斗:

4 月 24 日,DeepSeek 预览了 V4 全家族:

  1. V4-Flash:小模型,快、便宜,面向高频调用
  2. V4-Pro:旗舰,1.6 万亿参数(激活 490 亿),传说中的"满血版"

7 月 31 日,V4-Flash-0731 抢先转正:开源权重(MIT 协议)、Hugging Face 直接下载(166.9GB,48 个分片)、API 公测。Flash 总参数 304B、每次只激活约 13B,1M 上下文、最高 384K 输出。

8 月 13 日,主角 V4-Pro 正式版终于来了。官方 API 文档的定价页已更新——按照惯例,文档更新就是发布信号。

性能:打不赢第一,但价格是别人的七分之一

先说实话,V4 Pro 不是"全项第一"。

目前跑分流出图的共识是:比 Claude Opus 4.8 略强,比 Fable 5 弱一些。前有 Fable 5 和 GPT-5.6 Sol,侧有 Kimi K3,V4 Pro 想靠纯性能掀桌子,难度不小。

但 DeepSeek 从来不打这张牌。数据说话:

V4-Pro 预览版时,官方自测 SWE-bench Verified 距 Claude Opus 4.6 Max 只差 0.2 个百分点——而价格只有对方的七分之一

Flash 的 API 定价已经公开(官方人民币计价):输入 1 元/百万 token(缓存命中仅 0.02 元)、输出 2 元/百万 token。正式版 V4-Pro 定价同步出炉:输入 3 元、输出 6 元/百万 token,缓存命中 0.025 元。作为对比,Fable 5 的百万输出定价 50 美元(约 355 元)。同样是 Opus 级的能力,价格差近 60 倍。

还有一个耐人寻味的细节:DeepSeek 自己的模型卡显示,Flash-0731 在 agentic 评测上反超了 V4-Pro 的 4 月预览版。别急着说"Flash 吊打 Pro"——更合理的解读是:四个月里 Flash 进步太快,已经把那个四个月的旧预览版甩在身后了。这也意味着,正式版的 Pro 得跨过一个自己小兄弟设下的门槛。

最大变化:价格屠夫装了计价器

这次发布真正的新闻不是性能,是价格策略:DeepSeek 首次引入**“峰谷计费”**。

上个月底,DeepSeek 给所有 API 用户发了邮件:GA 发布后调整 API 定价,引入峰谷计费——高峰期贵一点、低谷期便宜一点。那个从不涨价的"价格屠夫",第一次给算力装上了计价器。

对个人用户影响不大。但对那些把 Agent 挂在工作时间不间断跑的团队,这是实打实要重新算的一笔账:白天高峰期的 token 账单会变贵,晚上的便宜时段则能省一笔。

好在缓存命中的价格依然极低。把批量任务、评测跑分、数据生成挪到高峰之外,成本还能压回去。这算是对"涨价"的缓冲。

怎么判断自己有没有灰度到

V4 GA 已经开始了灰度测试。有个民间"验货口诀"很好用:看思维链(CoT)的第一人称。

如果模型的思考过程开口是"I’m"“I’ll”,而不是老版本的"Let me"——恭喜,你大概率已经用上了 V4 GA 版。

首批体验者的反馈已经出来了:有人认为能打平 Claude 5,但也有开发者指出 Pro 版并未比 Flash 版领先太多。褒贬不一,但"价格显著更低"是共识。

另外提醒:deepseek-chat 和 deepseek-reasoner 两个老模型名,7 月 24 日已正式下线。还在用旧 API 名字的,赶紧改。

怎么看这次发布

DeepSeek 的牌从来不是"性能第一",而是那条被反复验证的老路径:把 Opus 级的能力,价格压到七分之一。

在动辄百万 token 几十美元的巨头面前,哪怕装上了"峰谷计价器",V4 依然是那个大杀四方的价格屠夫。

但计价器的出现是个值得注意的信号:当最强的价格玩家开始精细化管理算力成本,说明这个市场已经从"抢用户"进入"算账"阶段了。对用户来说,短期的直接好处是——性能追平 Opus 的模型,门槛又降了一截。

你在灰度名单里了吗?用上 V4 Pro 的,评论区聊聊感受。

0%