广告位 · header_banner

DeepSeek V4 Pro 8 月 13 日转正 + 8 月 18 日 API 涨价 11 倍:长上下文 reasoning 真实成本首次披露

8 月 13 日凌晨,DeepSeek 官网 API 定价页上”DeepSeek-V4-Pro-0813″的版本号悄悄从预览状态摘掉帽,正式转正。仅隔 5 天,8 月 18 日零点起,DeepSeek V4 全系 API 启用新价格,峰值时段(input + cache miss)单价从 ¥0.27/M tokens 涨到 ¥3.2/M tokens,涨幅约 11 倍——这是 DeepSeek 两年多以来第一次主动大规模调价。

为什么突然”贵了 11 倍”

复盘 8 月 13 日到 18 日的几次公开沟通,涨价的核心原因不是商业,而是推理成本:DeepSeek V4 Pro 把 1M 上下文的 reasoning 模式默认开启,加上”思考链 + 多轮工具调用”叠加,实际单请求消耗的算力是 V3 的 8-12 倍。8 月 18 日之前,DeepSeek 一直在用 V3 时代的低价补贴 V4 的长上下文成本,结果出现大量”薅羊毛”工作流——有人把 V4 当 V3 用,长 prompt + 高频调用,公司一晚上 GPU 集群账单翻了三倍。

新价格表分了三档:

  • 命中缓存:¥0.2/M tokens(基本是原价水平)
  • 非高峰 + 短上下文(≤128K):¥0.27/M tokens(和 V3 持平)
  • 高峰 + 长上下文(>128K)+ reasoning:¥3.2/M tokens(本次主要涨价档)

同步上线的还有”按需模式”和”批量预留模式”两个新计费通道,按需模式贵但保证 SLA,批量预留便宜 30% 但延迟放宽到分钟级,适合跑离线评估、夜间 ETL、批量标注。

谁在涨,谁没涨

横向对比同期 8 月发布的几款同档模型:

  • Claude Fable 5:¥18/M tokens 级别,DeepSeek 涨完仍是其 1/6 不到。
  • GPT-5.6 Sol:¥12/M tokens 级别,差价约 4 倍。
  • Qwen3.8 Max(2.4T 参数,8 月 3 日上线):保持与上代相近的低价,峰值档约 ¥1.1/M tokens。
  • GLM-5.3(8 月 14 日上线):完全沿用 5.2 定价,没有跟随涨价。

结论很直接:DeepSeek V4 Pro 涨价后,在长上下文 + reasoning 这个细分赛道上,仍然比闭源旗舰便宜一个数量级;但相对 Qwen3.8 Max、GLM-5.3 这些同档开源对手,峰值档的价差已经被压缩到 3-5 倍。DeepSeek 的护城河不再是”绝对便宜”,而是”V4 的长上下文推理质量 + 工具调用稳定性 + 国产合规”这套组合。

对开发者的实操影响

对已经接了 DeepSeek V4 Pro 的团队,这次涨价是一次典型的”分层计费改革”,不是”全面涨价”,三件事值得立刻做:

  • 把 system prompt 拉长、把 cache 命中做高:命中缓存档与原价持平,正确使用前缀缓存能把长上下文工作流的有效单价压回 V3 水平。
  • 把 reasoning 拆成”按需开关”:不是所有任务都需要深度推理,简单分类、抽取、JSON 格式化可以切回非 reasoning 档。
  • 把”高峰长上下文”任务迁到批量预留或开源替代:夜间跑批的代码生成、文档总结,可以走 Qwen3.8 Max 或 GLM-5.3,白天在线请求继续用 DeepSeek V4 Pro 命中缓存档。

从行业角度看,DeepSeek 这次调价大概率是 2026 年下半年最重要的价格信号——长上下文 reasoning 的真实成本被第一次系统性披露,接下来 1-2 个月会看到 Qwen、GLM、文心一言陆续跟进”分层计费”,纯按 token 单价报价的时代正式结束。

广告位 · footer_banner
广告位 · sidebar_rect