明天中午12点,DeepSeek开放平台的新价格正式生效。IT之家9月9日刊出的对比表我逐项核了一遍:Flash系列缓存命中输入,空闲时段从每百万token 0.05元降到0.02元,高峰时段从0.10元降到0.04元,降幅都是60%;缓存未命中输入从1.5元降到1元,降幅约33%;输出从4.5元降到4元,降幅约11%。
今天知乎热榜上那个问题说得更直白——"除输出外,回归8月17日前价格"。翻译一下:上个月涨上去的输入价格,基本原样退了回来。
一次涨价,一次回调,中间发生了什么
把时间线摆出来就清楚了。21世纪经济报道梳理过:8月13日,DeepSeek发布V4 Pro正式版的同时宣布调整API价格、引入峰谷计费,新价格8月17日零时生效。中关村在线的评价不留情面:V4 Pro性能提升未达预期,随后的价格调整引发用户广泛讨论,"品牌信任度受到一定影响"。
也就是说,这次回调不是孤立的降价促销,更像是对8月17日那次涨价的修正。输入端涨得最狠的,这次也降得最狠(60%);输出端当时涨得温和,这次也只象征性降了11%。涨多少、退多少,账算得很清楚。
但我觉得更值得看的,是回调的时机。9月8日,V4.1 Flash中间版本刚开启内测,模型名里直接写着expires-on-0910——9月10日自动下线,和新价格生效是同一天。这个内测版换了全新架构、原生支持多模态,开发者实测输出速度最高到507 tokens/s,SVG代码生成比上一代快6倍。更耐人寻味的是内测问卷里的问题,顶端新闻记者注意到,DeepSeek直接问用户:"你觉得这个模型能全面替换线上的V4 Pro么?"
内测到期日、新价格生效日、"Flash能不能替掉Pro"的调研,三件事挤在同一天。方向已经很明显:DeepSeek想把"又强又便宜"这件事押在Flash系列上。高峰时段每百万输出token,Flash收9元,Pro收27元,三倍差价摆在那里——如果V4.1 Flash真能顶替Pro的活儿,日常大量调用走Flash,账面上就是另一番天地。
对普通用户意味着什么
说实话,如果你只是用App聊天,这些API价格跟你关系不大。但它透露的规律跟每个人都有关:AI的价格会像菜市场一样波动,会用的和不会用的,成本差出几倍。
从这轮调整里能读出三条实用信息:
一是峰谷计费已经是行业常态。同一件事,高峰时段跑和空闲时段跑,价格差一倍(DeepSeek的空闲价统一是高峰价的一半)。批量任务、不急的任务,挪到空闲时段跑,等于白捡五折。
二是缓存命中便宜到几乎不要钱。命中缓存的输入只要0.02元/百万token,是未命中价格(1元)的五十分之一。多轮对话、重复喂同一份资料时,尽量在一个会话里连续问,别每次都重新开一段。
三是"便宜模型"正在变得能打。内测开发者的吐槽很有意思:速度快了,"5分钟10块钱",token烧得也更快。这说明光看单价不够,要看"完成任务的总成本"——一个快6倍的模型,哪怕单价不变,你等的时间成本也省下来了。
我平时在spark1.cn的工具链页面(/toolchains)整理各类AI工具时,也是按这个思路记账的:不追最贵的,只算"把这件事做完总共花多少"。
价格战还会继续打,模型还会继续换。学会看价格表、按任务选档位,比记住任何一家的报价都更长久——行情会变,会算账的人永远从容。
💬 评论