跳到主要内容

DeepSeek V4 7 月中旬正式上线:高峰时段 API 价格翻倍,永久降价后的精细化分层

2026 年 6 月 29 日,DeepSeek 向部分用户发送了一封升级提醒邮件,把"7 月中旬正式上线 V4"和"峰谷时定价机制"两个动作捆绑预告。6 月 30 日,观察者网率先披露了这封邮件的细节。真正值得开发者关注的,不是"涨价"这个表面动作,而是它背后 DeepSeek 整套定价策略从"统一便宜"切换为"精细化便宜"的拐点。

一、邮件里的两个关键动作

根据观察者网披露的邮件内容,DeepSeek 同步释放了两条信息:

  1. V4 正式版计划于 7 月中旬上线,伴随更多功能优化和性能提升;
  2. 同步引入峰谷时定价机制:北京时间每日 9:00–12:00 与 14:00–18:00 被划为高峰时段,调用价格为平时的 2 倍;其余时段按平时价计费。

邮件同时承诺,任何相关调整发生前 24 小时,会通过邮件通知用户。这是一条对工程团队非常友好的缓冲条款——它给了运维一个完整工作日来完成流量切换、缓存预热或限速重排。

二、峰谷时段的真实价格表

把高峰翻倍叠加到 V4 现有定价上,4 个时段 × 3 档成本共 12 个数字。整理如下(每百万 tokens,人民币):

时段模型缓存命中输入缓存未命中输入输出
平时V4-Flash0.02 元1 元2 元
平时V4-Pro0.025 元3 元6 元
高峰V4-Flash0.04 元2 元4 元
高峰V4-Pro0.05 元6 元12 元

对照 5 月 23 日永久降价前 V4-Pro 最高 24 元/百万 tokens 的历史高位,即便把高峰翻倍纳入计算,V4-Pro 输出价仍只有当初的一半。换句话说,"涨价"是相对 5 月底那个甜蜜点而言,而不是相对 4 月 V4 Preview 上线时。

三、对 AI 应用的真实影响:以 V4-Pro 输出为例

观察者网给出了一个非常直观的成本对比:一家 AI 应用在高峰时段每天消耗 1 亿输出 tokens,平时成本约 600 元,高峰价下约 1200 元;如果消耗量上升到 10 亿输出 tokens/天,成本则从约 6000 元升至 1.2 万元。客服、代码助手、办公 Agent、搜索增强问答这类典型高峰叠加高频的应用,价格翻倍会直接挤压毛利率。

这意味着三件事:

  • 必须有"高峰避让"设计:把能延后的批处理任务、离线分析任务、可异步重试的对话打包到 18:00 之后;
  • 必须重新评估 Prompt 长度:高峰时段每多 1K 输入 token 都要按 0.05 元/百万(V4-Pro 缓存命中)计费,这是 V3 时代根本不会触发的小数点级心疼;
  • 必须把 Context Caching 推到默认开启:缓存命中与未命中在高峰时段被同步翻倍,但两档之间的绝对价差被同时放大——这意味着 V4 时代做缓存优化的边际收益比 V3 时代更高。

四、国际市场对照:依然"真香"

把视线拉到海外,DeepSeek 涨价的"底气"非常清楚。按高峰翻倍测算,V4-Pro 输出约 1.74 美元/百万 tokens,对比 OpenAI 官方价格页 GPT-5.5 标准 API(输入 5 美元、缓存输入 0.5 美元、输出 30 美元/百万 tokens)与 Anthropic Claude Opus 4.8 常规价(输入 5 美元、输出 25 美元/百万 tokens),OpenAI 与 Anthropic 高端模型输出价仍约为 DeepSeek V4-Pro 峰时价的 14–17 倍

这组数字是 DeepSeek 敢于在 7 月份"涨价"的真正筹码:它不是在试探用户对涨价的容忍度,而是在用国际差价给自己留出充足的竞争缓冲。对预算敏感的海外用户来说,DeepSeek 的峰时价依然处于"价格锚"的低位。

五、背景:从"涨价前的永久降价"到"精细化便宜"

这并不是 2026 年 DeepSeek 第一次调价。回顾时间线:

  • 4 月 24 日:V4 Preview 上线,V4-Pro(1.6T/49B)与 V4-Flash(284B/13B)公布 1M 上下文与双档并发(V4-Flash 2500 / V4-Pro 500);
  • 5 月 23 日:把 V4-Pro 原 75% 优惠价转为永久价,API 最高价从 24 元/百万 tokens 降至 6 元/百万 tokens;
  • 6 月 29 日:邮件预告 7 月中旬 V4 正式版 + 峰谷时定价。

可以看到 DeepSeek 的定价节奏非常清晰:先用 Preview 锁住头部用户,再用永久降价把生态拉宽,最后用峰谷时段把"算力稀缺"显式定价。这不是放弃低价路线,而是把低价策略从"一刀切便宜"升级为"按时段精细分层"。

六、行业趋势:海外企业正在被"多模型路由"反向教育

观察者网同时点出了 DeepSeek 涨价的宏观背景:

  • 过去几个月海外大模型定价模式从固定订阅转向按 tokens 计费,企业使用成本快速攀升;
  • Uber 4 个月烧完全年 AI 预算,不得不限制高管使用,被称为"第一个叫停 AI 烧钱的大厂";
  • 微软、Coinabase 等公司高管开始强调**"许多任务并不总需要最昂贵、最大的模型"**;
  • OpenRouter 数据显示,开源模型已承担其平台约 65% 的 token 处理量,以 DeepSeek 为代表的中国低成本模型使用量明显上升。

这意味着,DeepSeek 引入峰谷时定价其实踩在了"企业 AI 预算收紧"这个全球性窗口期。海外市场正在主动重排路由策略——简单任务交给便宜模型、复杂任务再交给高端模型——而 DeepSeek 顺势把"便宜"这件事做成可量化的时段产品。

七、给开发者的实操清单

把上述信息转译为 7 月中旬之前的工程动作:

  1. 建立"高峰流量地图":用 2–4 周的真实日志画出每个 endpoint 在 9–12 / 14–18 时段的请求密度与 token 消耗,识别可平移的批处理任务;
  2. 重排任务调度:把夜间可执行的 ETL、长文档摘要、批量分类、向量重算等任务强制写到 18:00 之后的"平时"窗口;
  3. 把 Context Caching 当作默认能力:高峰时段两档价差被同步放大,缓存优化的 ROI 显著上升,建议把命中目标从 30% 提到 60%;
  4. 7/24 前完成账单回放:用近 30 天真实流量重放到新价表,量化峰谷时的"涨价幅度",并对每个 SKU 设置月度预算告警;
  5. 关注 DeepSeek 官方邮件:邮件承诺 24 小时提前通知,建议把 api-service@deepseek.com 加入 IM 告警通道,避免被动响应。

八、写在最后

DeepSeek 在 7 月中旬把 V4 正式版和峰谷时定价一起端出来,本质上是一次定价哲学的升级:从"统一便宜"切换为"按时段精细分层的便宜"。高峰时段价格翻倍听起来扎眼,但与国际同业 14–17 倍的价差依然成立。对开发者来说,7 月中旬的真正作业不是"抱怨涨价",而是重新设计流量调度:哪些任务必须高峰跑、哪些任务可以平移到谷底、哪些任务可以靠缓存命中躲过翻倍——这些问题的答案会直接决定下一个季度的 API 支出。

资料来源:观察者网独家报道(2026/06/30,原文链接 m.guancha.cn/economy/2026_06_30_822053.shtml)、DeepSeek 6/29 升级提醒邮件、DeepSeek 官方 API 文档(api-docs.deepseek.com/quick_start/pricing)。本文基于 2026/07/02 公开信息撰写,V4 正式版与峰谷时定价的最终细节以 DeepSeek 官方 7 月公告为准。