DeepSeek 涨价、美系降价:「价格屠夫」时代是怎么在这个八月结束的
八月这半个月,AI 圈发生了一件挺拧巴的事:一直被叫"价格屠夫"的 DeepSeek 涨价了,而且涨得不轻;大洋对岸的 OpenAI、Anthropic 反而在降价、或者取消了原定的涨价。同一个八月,同一个行业,价格方向完全相反。这不是谁良心谁不良心的问题,背后是同一条曲线上两个不同的位置——看懂这条曲线,比记住哪个便宜哪个贵更有用。
发生了什么:一张表看懂涨价和降价
时间线是这样的:DeepSeek 先在 08-06(周四)向开发者预告"计划近期整体上调 API 服务的定价,预计涨幅较大",08-13(周四)发布正式调价公告,新价格 08-17(周一)北京时间零时起生效
报。要说明一点:"峰谷分时计价"不是这次才有的,它在 7 月中旬就已经先行落地,这轮调价是在峰谷机制之上再把基准价抬上去
报。同一周,大洋对岸的两家美国厂商动作相反。
| 厂商/模型 | 动作 | 生效/宣布时间 | 价格变化 |
|---|---|---|---|
| DeepSeek V4-Pro(高峰时段,输出) | 涨价 | 08-17(周一) | 6元→27元/百万token,涨约350% |
| DeepSeek V4-Pro(高峰时段,缓存命中输入) | 涨价 | 08-17(周一) | 0.025元→0.30元/百万token,涨约1100% |
| DeepSeek V4-Pro(空闲时段,输出) | 峰谷新价 | 08-17(周一) | 13.5元/百万token,约为高峰一半 |
| OpenAI GPT-5.6 Luna | 降价 | 07-30(周四) | 输入输出各项合计约降80% |
| OpenAI GPT-5.6 Terra | 降价 | 07-30(周四) | 输入输出各项合计约降20% |
| Anthropic Claude Sonnet 5 | 取消原定涨价 | 08-10(周一)宣布 | 维持$2/$10,原定09-01涨到$3/$15的计划撤销 |
DeepSeek 的数字来自官方定价页,08-17 生效后 V4-Pro 高峰时段输出价从每百万 token 6 元涨到 27 元,缓存命中输入价从 0.025 元涨到 0.30 元,和多家媒体报道的数字一致
源
报。OpenAI 这边,Luna 从每百万 token 1 美元输入/6 美元输出砍到 0.20/1.20 美元,Terra 从 2.5/15 美元降到 2/12 美元,旗舰 Sol 没动,官方给出的理由是内部模型训练效率的提升,时间点也正好卡在 Anthropic 发布 Opus 5、Google 发布 Gemini 3.6 Flash 之后
报。Anthropic 这边最值得注意:Sonnet 5 原定 09-01(周二)从每百万 token 2/10 美元涨到 3/15 美元的计划,08-10 被官方直接撤销,2/10 美元变成了永久价——不是"促销延期",是把这个价格钉死了
源。
峰谷计价:国内大模型 API 头一回这么玩
比涨价数字本身更值得聊的,是 7 月中旬起落地、这轮调价一并保留下来的"峰谷分时计价"。DeepSeek 把工作日北京时间 9-12 点、14-18 点定为高峰,价格是空闲时段的两倍;晚上、周末这些时段,同样的模型价格直接打对折
源。这套玩法在电价、火车票、网约车上大家都见惯了,但主流大模型 API 上还是头一回,目前看是 DeepSeek 领先做的
报。
背后的逻辑不难猜:那两个时间段恰好是全国公司上班、企业级 Agent 应用集中跑批的时间——GPU 是稀缺资源,白天扛不住的就是这一波并发。给个实用建议:如果你自己在跑一些不着急出结果的 AI 任务(比如批量整理文档、离线跑测试),把任务挪到晚上或周末执行,同样的活儿能省一半钱,这是这次调价里少数对用户友好的部分。
一笔账:实付到底多花多少
先说结论:普通人用手机上的 DeepSeek App 或网页版聊天,一分钱没多花——这次涨的只是开发者调用的 API,消费级免费应用完全没动
源。真正肉疼的是那些拿 API 搭了产品的开发者和小团队。
有一个被媒体报道的真实案例:一位开发者做了个"分析屏幕内容自动生成待办事项"的 AI 小工具,靠持续调用 API 跑,涨价前月账单大约 3000 元,涨价后逼近 1 万元,涨了 3 到 4 倍
报。他原来没打算向用户收费,现在正考虑把 AI 功能改成付费——这基本就是这轮涨价最典型的传导路径:成本从 DeepSeek 传到开发者,再从开发者传到终端用户。报道里还提到智谱、Kimi 等同行也跟进了类似调整,涨价看起来不是 DeepSeek 一家的选择
报。
换成更小的量级感受一下:一个只是拿 API 跑点轻量自动化(比如每天几十次任务、总共几百万 token 输出)的个人开发者,如果任务主要压在工作时间跑,原来一个月十几块钱的账单,现在很可能变成五六十块——涨幅比例和上面案例的 3-4 倍基本一致,只是绝对金额小很多。真金白银的痛感,取决于你把多少任务压在了 9-12 点和 14-18 点这两段高峰里。
为什么会分化:两件事,还是同一件事的两面
表面看是"国产涨、美系降"的对立叙事,但拆开看,双方手里握的其实是同一条曲线上的两个变量在打架:一边是单位算力成本(靠模型效率提升、芯片进步、同行竞争压下去),另一边是需求量(尤其是 Agent 应用把单次任务的 token 消耗量拉到传统对话的百倍以上)。谁涨得更快,价格就往哪边走
源。
美国这边打的是"降成本"这张牌:OpenAI、Anthropic 半年内密集迭代新架构,叠加 Opus 5、Gemini 3.6 Flash 逼出来的同行竞争,降的是本来就有议价空间的中低端产品线,旗舰型号(Sol)反而没动;Anthropic 把 Sonnet 5 的入门价钉成永久价,某种程度上也是在用"锁定低价"抢市场份额,而不是财大气粗做慈善。中国这边 DeepSeek 打的是"需求撞上产能天花板"这张牌,这条论证得分两层说清楚,不能混着讲。
第一层是官方口径。DeepSeek 自己在调价里给出的解释只有很短一句——为了"更合理地配置资源、提升服务稳定性";此外据媒体转述,公司提到的因素还包括智能体应用带来的 token 消耗激增、高端 AI 芯片供应受限推高算力成本、行业从补贴换规模转向可持续商业模式这三条。这几句是转述,不是可以点开核对的官方长文,坊间流传的"单任务消耗是传统对话的百倍""两年调用量涨一千倍"这类精确倍数,更是分析师和媒体的估算而非官方数字,别当官方口径引用
报。
第二层是不依赖任何转述、可以独立核实的事实,这才是判断"为什么涨"的硬地基:开源 Agent 工具 OpenCode 披露,08-01 单日经它手的 V4-Flash token 处理量就有 8 万亿,其中 5 万亿来自免费额度;08-04 当天 V4-Flash 的官方 API 因"前所未有的访问量"出现容量不足、几近不可用;模型路由平台 OpenRouter 的统计里,V4-Flash 一度占到全平台约 58% 的 token 份额
报。也就是说,调用量确实撞上了供给上限——这一点看得见摸得着,至于官方是不是把它当成涨价的主要理由,只能存疑地转述。这轮涨价与其说是"割韭菜",不如说是把之前透支的补贴收回来。
所以更准确的说法不是"谁厚道谁不厚道",而是两边正站在同一条效率-需求曲线的不同位置。如果国内算力供给跟上(H200 部分重新流入、国产芯片爬坡),DeepSeek 没理由不跟着往下调;反过来,如果哪天美国大厂也撞上了 Agent 需求的指数级增长、算力供给跟不上,同样的涨价剧本大概率会在美股这边重演。
对你意味着什么
如果你只是日常聊天用 DeepSeek App,这次调价跟你没关系,该怎么用怎么用。
如果你在用 DeepSeek API 自己搭产品或者跑 Agent 工作流,先把账单拉出来看一眼峰谷分布,能挪到晚上、周末的批量任务尽量挪,能省下的是实打实的一半;如果你的应用本来利润就薄,现在是该认真算一下要不要把这部分成本转嫁给终端用户的时候了,前面那位开发者的选择——从免费改收费——大概率不是个例。
如果你在关注国内外大模型公司的商业化进展,可以把这次分化当一个信号:美系"降价抢份额"和国产"涨价补窟窿",本质上都在说同一件事——靠亏本换用户增长的阶段正在结束,谁先把价格摆到接近真实成本的位置,谁就先证明自己的商业模式能不能站得住。
延伸阅读:站内整理的全球 AI 订阅与 API 价格总表 全球 AI 订阅/API 价格总表。
标记:
源=一手官方页面/公告,
报=媒体报道(含引用官方说法但未直接核到一手公告原文)。