首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >先涨350%再打五折,DeepSeek价格过山车的真相

先涨350%再打五折,DeepSeek价格过山车的真相

作者头像
用户12724357
发布2026-09-15 19:12:30
发布2026-09-15 19:12:30
580
举报

一周两次调价,DeepSeek把开发者带上了过山车

8月17日零点,DeepSeek API涨价生效。旗舰模型V4-Pro高峰时段的输出价格从6元涨到27元,涨了350%;缓存命中的输入价格从0.025元涨到0.3元,涨了1100%。不少开发者的账单,一夜之间翻了四倍多。

六天后的8月23日零点,又一纸公告:周六周日全天不再区分峰谷,统一按低谷价格计费。周末调用,直接半价。

先狠涨一波,又小幅降价,是市场逼的吗?我把两次调价放在一起算了笔账,发现它们不是反复无常,而是同一张棋盘上的两步棋。

涨是限流,降是填谷,背后是同一本算力账。

现象:半年里的价格过山车

先把时间线捋直。

今年5月,DeepSeek来了个「永久2.5折」:每百万tokens输出6元,缓存命中输入低到0.025元,全球大模型最低价。靠这个地板价,V4-Flash冲上了全球调用量榜首。

8月13日官方公告调价,17日生效:全面涨价,同时首次引入峰谷分时计价。每天9点到12点、14点到18点是高峰时段,其余时间算低谷,低谷价格是高峰的一半。V4-Pro高峰输出27元,低谷13.5元。

8月23日,规则再优化:周末两天全天按低谷价,几点调用都是半价,法定节假日也全天按低谷价执行。

DeepSeek-V4-Pro 输出价格:半年过山车每百万 tokens 输出价格(元)0元10元20元30元6元+350%27元13.5元13.5元5月23日「永久2.5折」8月17日起高峰时段8月17日起低谷时段8月23日起周末全天数据:DeepSeek API开放平台公告 · 制图:不吃葡萄的蜗牛丨AI手记

三次动作,方向看着矛盾,其实是一条线:白天工作时段贵,晚上和周末便宜

补一句安心的话:这轮调价只针对API调用,也就是把模型接进自己产品的开发者和企业。

主因:一本算力账

主因就俩字:算力。

5月的地板价把调用量拉爆了。OpenCode的CEO后来透露:V4-Flash上线两周,日token用量从3万亿涨到18万亿,6倍,相当于再造了一个OpenRouter的全部日流量。服务器就那么多,白天企业客户扎堆调用,高峰期挤到爆。

怎么办?涨价。而且立竿见影:涨价后调用量降了一半以上。

注意,降调用就是目的。价格在这儿不是报价,是闸门:付得起的留下,不急的活儿挪走。

那周末为什么又降?看一眼高峰时段的定义就明白了:9点到12点、14点到18点,正好是工作时间。周末企业不开工,负载天然回落,算力闲着也是闲着。这时坚持高价,只会把本可以接的批量任务吓跑。

**闲置算力的边际成本几乎为零,半价把夜里的活儿、周末的活儿吸引回来,进来就是净赚。

一涨一降,一限流一填谷。电力行业玩了几十年的峰谷电价,就是这个套路,DeepSeek只是把电价表搬到了token上。

为什么先涨后降:一本主账,两个助推主因定方向,次因定节奏一周两次调价主因:算力供需(一本账的两面)「涨」= 限流需求6倍爆炸,白天高峰挤爆涨价后调用量降50%+,目的达到「降」= 填谷周末企业歇工,算力闲置半价吸引批量任务回流,净赚同款套路:电力行业的峰谷电价次因① 舆情修复1100%涨幅在开发者圈挨骂一周内给甜头,安抚社区情绪次因② 行业转向智谱年内涨3轮,腾讯云涨2次低价获客转向价值定价调用量数据来源:OpenCode CEO 公开披露制图:不吃葡萄的蜗牛丨AI手记 · 2026-08

还有一层商业账。低价时代的角色是获客:把调用量做到全球第一,把开发者生态圈进来。

生态稳了,再涨价筛掉低价值流量,留下的都是付得起钱的。先渗透,后收割,教科书式的打法。

次因:两个助推

主因之外,还有两个次要因素,决定了这次调价的节奏和姿态。

一是舆情。1100%这个数字在开发者圈子里炸了锅,有人把梁文锋的昵称从「梁圣」改成了「牢梁」。一周之内给出周末降价这个甜头,有明显的安抚成分:告诉大家价格是可谈的,不是一刀切。

二是行业风向。今年国内厂商在集体涨价:智谱年内已经涨了三轮(2月结构性调价、3月涨20%、4月再涨10%),腾讯云涨了两次,阿里云、百度智能云也都调过价。整个行业从「低价获客」转向「价值定价」,DeepSeek不是孤军深入,是有同行垫背。

但要说清楚:这两个因素影响的是节奏,方向盘还是握在算力供需手里。没有算力紧张,舆情再大也涨不动;没有算力闲置,周末再想安抚也降不了。

影响:token正在变成电费

这趟过山车,最值得记住的结论是:token计价正在电价化

有峰有谷,按时计价,其他厂商大概率跟进。

对开发者,省钱就三招。

错峰:批量任务挪到工作日18点以后、午休时段,或者排到周末,成本直接减半。

缓存:高频重复的内容(固定提示词、常见问答)命中缓存,命中后输入价格最低只要0.15元,这个就得选厂家支持的Agent了。

分层:简单任务用V4-Flash(高峰输出9元),复杂推理才上V4-Pro(27元)。三招叠起来,成本能省一半以上。

DeepSeek 峰谷时刻表:什么时候调用最便宜V4-Pro 输出价:高峰 27 元 / 百万tokens,低谷 13.5 元周一至周五峰峰0点9点12点14点18点24点周六周日全天低谷价 · 半价法定节假日全天低谷价 · 半价高峰(全价)低谷(半价)省钱三招:错峰 · 缓存 · 分层批量任务挪到夜间或周末,成本直接减半据 DeepSeek 官方公告(2026-08-23 生效)· 制图:不吃葡萄的蜗牛丨AI手记

已经有公司走得更快:有团队为了对齐谷时段,把排班改成「每周非周末休一天、周末再休一天」,午休挪到14点以后,知乎上为此吵翻了天。

我的看法:个人和小团队犯不着这样。写个定时脚本,让任务半夜自己跑,比改人的作息划算。省下的是token钱,搭进去的是协作效率,这账不划算。

大洋对面是另一个方向:

8月21日起OpenAI把GPT-5.6 Sol的基准价降了20%多,谷歌Gemini 3.7 Flash直接五折,Anthropic取消了原定的涨价。这些应该是被中国开源大模型逼的,主动是不可能的。

一边涨一边降,不是谁对谁错:

中国厂商算力紧,用价格调度需求;美国厂商压力大,用降价守住客户。方向相反,都是生意。

知道这些,对你有什么用

认知上:token有峰有谷,往后看API价格,要像看电费单一样看时段。涨价和降价都是调度手段,不是翻脸,也不是发糖。

别为省token钱去改团队作息,时间成本、协作成本也是成本。调价公告会有邮件提前通知,盯紧官方渠道,比猜市场管用。

token越来越像水电费,有峰有谷,按时计价。会用时段差的人,永远比只会比单价的人便宜一半。

#DeepSeek #大模型API #峰谷计费 #AI算力 #人工智能

信息来源:DeepSeek API开放平台公告(8月13日、8月23日);证券时报2026-08-23;中国蓝新闻2026-08-24;V4-Flash调用量数据来自OpenCode CEO公开披露。

喜欢就点击关注我哦~

本文参与 腾讯云自媒体同步曝光计划,分享自微信公众号。
原始发表:2026-08-25,如有侵权请联系 cloudcommunity@tencent.com 删除
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档