OpenAI 降价 80%,DeepSeek 涨价 1100%:大模型价格打成了「峰谷电费」,你的 API 预算该重算了
8 月 17 日,大模型行业发生了方向相反的两件事。
同一天:OpenAI 把 GPT-5.6 Luna 的价格砍掉 80%;DeepSeek 把 V4-Pro 高峰时段的 API 价格最高上调 1100%,缓存命中价上调 12 倍。曾经的价格屠夫开始涨价,曾经的贵族开始跳水——大模型的价格,正式打成了**「峰谷电费」**:分时段、分档位、随供需浮动。
这篇照例拆三层:两边为什么反向走、剪刀差意味着什么,以及最重要的一工程侧现在就该重算的三笔账。

事实全景:一张表看清谁涨谁降
涨的这一边(国产为主):DeepSeek 8/17 大幅调价(高峰时段最高 +1100%),8/23 又更新规则、周末统一按低谷价计费;智谱年内完成三次价格调整,GLM Coding Plan 从次数制改积分制,三档月费上涨 141%~261%;腾讯混元年内两次涨价,输入最高 +463%;百度、阿里的算力产品集体上调 5%~34%。摩根士丹利把这轮概括为**「告别价格战」**。
降的这一边(海外为主):OpenAI 的 Luna 直降 80%,GPT-5.6 Sol 还在 OpenRouter 和 Vercel AI Gateway 上做了限时半价(9 月 18 日到期);Anthropic 的 Claude Opus 5 定价只有自家旗舰 Fable 5 的一半;Google 的 Gemini Flash 三款新模型全线低价。第三方 Silicon Data 的 token 价格指数显示:7 月中旬以来,美国主流模型的实际支付价格已下降近 25%。
读法一:反向的根源是两边站在不同的成本曲线上
为什么国产涨、海外降?不是谁良心发现,是各自的处境不同。
涨价的逻辑:需求真实到供不应求。 Kimi K3 发布 48 小时请求量超限、被迫暂停新用户订阅;国产推理需求爆发撞上算力成本上抬——2026 年 Q2 传统 DRAM 合约价环比上涨 58%~63%,HBM3E 供应价格上调约 20%,美光说数据中心需求是可承诺供应量的 150%,英伟达整机也因存储成本(BOM 占比从 53% 升到 62%)涨价约 15%。当边际成本压不住了,从「抢份额定价」切换到「按成本定价」是必然——这就是大摩说的告别价格战。
降价的逻辑:上市窗口期,用亏损换开发者生态。 Anthropic 筹备着可能是史上最大的 IPO,OpenAI 暂缓上市但要用份额数据讲故事。降价的战果可以量化:OpenRouter 9 月 7–13 日窗口的统计显示,开发者花在 OpenAI 模型上的钱,两年半来第一次超过 Anthropic——头号功臣不是跑量模型,是全站最贵的 GPT-6 Astra(占两家合计支出约 19%)。
而 DeepSeek 那个「周末统一低谷价、闲时半价」的定价结构,其实是把电力行业的需求侧管理搬进了 API:用价格信号把可延迟的负载挪出高峰。这不是涨价,这是在教你调度。
读法二:剪刀差——开源模型量大钱少
Vercel AI Gateway 的数据给了一个扎心的视角:2026 年 6 月,开放权重模型(以中国开源系为主)拿走了大量 token 调用份额,收入份额却远远不匹配。量价剪刀差意味着:开源系在用近乎成本价的服务换全球开发者心智,闭源系在从真实付费用户身上回收研发投入。
这也是本篇标题里那组数字的真正含义——80% 的降价和 1100% 的涨价可以同屏出现,因为它们瞄准的根本不是同一个市场。降价抢的是心智和迁移率,涨价收的是已经离不开的人的钱。判断你自己的处境只需要一个问题:你的负载是「可以随时换模型的」,还是「深度绑定某家工作流的」?前者享受价格战红利,后者承受涨价全压。
读法三:三笔账,工程侧现在就能省

给团队(和我课上学生)的三笔账,全部可操作:
第一笔,缓存账。 DeepSeek 缓存命中价上调 12 倍后,这项「曾经便宜到可以忽略」的开支正式进入预算表。对策:稳定内容前置、变化内容后置——把系统提示、代码仓库、规范文档这些不变的部分放在前缀,动态字段放后面,别让一个每次都变的字段打断整条缓存链。对长链路 Agent 应用,缓存命中率直接决定成本结构。
第二笔,时段账。 闲时价格约为高峰一半。日志分析、离线评测、批量文档抽取这类不赶时间的任务,调度到 0–9 点、12–14 点或 18–24 点跑,成本直接砍半。把 cron 写好,一年省下的钱够加一个人。
第三笔,选型账。 默认模型不等于最便宜的模型:入口分流用小模型、复杂推理才上旗舰之外,还要盯住长链路 Agent 的隐性成本——上下文膨胀、缓存断裂、失败重试,经常吃掉单价差。用私测集算「单任务全成本」,别只比每百万 token 单价。
一盆冷水
三句照例:其一,1100% 是高峰时段上限涨幅,不是均价涨幅,转述时丢掉「高峰时段」「最高」两个限定词,就是又一例口径事故;其二,OpenRouter 的「反超」只统计聚合平台支出,不含直连 API 和企业合同,也不等于用户数——「OpenAI 赢了」这个结论先别下;其三,涨价潮可能反噬普及——独立开发者和学生党的预算是刚性的,价格每上一个台阶,就有一批人退回免费档或转向开源本地部署。厂商在「告别价格战」,但用户也会用脚告别。
写在最后
我在课上讲「推理成本账」讲了两年,案例库从没像这两个月这样饱满过。给学生的结论也简单:会调度的人,正在从会调 API 的人里分化出来——缓存怎么排、任务几点跑、模型怎么分流,这些「土办法」比追新模型更能省真金白银。
政企校的 API 预算审计和闲时调度改造,正是我们最近接得最多的活儿之一——账单发过来,通常第一天就能找出 30% 以上的可省空间。想算这笔账的团队,欢迎交流。
参考来源
- 知乎专栏:OpenAI 降价 80%,DeepSeek 涨价 1100%——大模型价格战为何打成了「峰谷电费」
- 知乎专栏:2026 AI 模型定价权战争(Vercel AI Gateway 量价剪刀差)
- 知乎专栏:国产涨价、OpenAI 降价——企业该重新算哪几笔账(缓存/时段/选型三账出处)
- 腾讯新闻:大模型涨价「卷」起来(智谱三次调价、腾讯两次、周末低谷计费)
- 知乎专栏:DeepSeek 也扛不住了——大模型集体涨价,独立开发者怎么活
- 网易:三个月价格腰斩,大模型的「聪明」正在贬值?
- 知乎专栏:阿里 800 亿港元配售、英伟达涨价 15%、OpenAI 降价 20%(存储成本推手)
- 网易:2.5 年来第一次,OpenRouter 用户把钱花给了 OpenAI
- 什么值得买:降价 80%,又贵 50 倍——OpenAI 把开发者钱包赢回来了(OpenRouter 9.15 统计)
- 知乎:时隔两年半,OpenAI 用户周支出反超 Anthropic 的原因与口径边界
- 网易:千问、智谱开始做地推抢用户(杭州 Token 卡与线下活动)
- 36 氪:智谱融资背后——一场没有枪声的卡位战(资本与价格战同框背景)