
DeepSeek 也学会收电费了。
8 月 17 日零时起,DeepSeek 新版 API 价格正式生效,V4-Flash 和 V4-Pro 两款主力模型头一回搞峰谷定价。
每天北京时间 9 点到 12 点、14 点到 18 点,一共 7 小时算高峰,剩下 17 小时算闲时,闲时价格统一打五折。
听着耳熟吧。
居民用电就这么收的,白天贵,半夜便宜,鼓励你错峰。如今买 Token 也讲究起作息时间了。
打五折听着挺美,可你把新旧价格摆一块儿看,味道就变了。
这次调整顺手把基础价抬了一大截。
拿 V4-Pro 说,原来缓存命中输入、缓存未命中输入、输出,每百万 Tokens 分别收 0.025 元、3 元、6 元。
新价目表上,高峰时段这三项变成 0.3 元、9 元、27 元,涨幅分别是 1100%、200%、350%。
就算掐着半夜的闲时用,也比老价格贵,涨幅 500%、50%、125%。
V4-Flash 同样跑不掉。
原来 0.02 元、1 元、2 元,现在高峰时段 0.1 元、3 元、9 元,闲时 0.05 元、1.5 元、4.5 元。
整体算下来,涨幅从 50%到 1100%。
那个 1100%挺扎眼的,缓存命中输入,从两分五涨到三毛。
好在基数小,绝对数看着不吓人,可这个涨法,说实话,很有当年网约车补贴退坡的味道。
先把人请上车,再把票补回来。
有人问,DeepSeek 缺钱了吗?
我倒觉得,与其猜它缺不缺钱,不如看它想干什么。
官方没解释涨价原因,但峰谷定价这个设计本身,把底牌亮出来了。
模型推理要持续占算力,白天企业和开发者扎堆调用,集群喘不过气,半夜机房空转,利用率掉下去。
价格杠杆往这儿一放,批量数据处理、代码生成、模型评测这类不着急的活,自然被赶到闲时去,高峰压力缓了,集群利用率上来了。
省下来的调度成本,可比多收的那点 Token 费值钱。
这招说白了,是把算力当电力经营。
发电厂最怕峰谷差,智算中心也一样。DeepSeek 干的事,跟电网公司一个思路,用价格把需求削峰填谷。
从这个角度看,涨价涨得理直气壮,甚至涨得挺聪明。
只是苦了那批跑实时业务的开发者。
实时对话、在线 Agent,用户什么时候来,请求就什么时候到,躲不开高峰那 7 个小时。
能错峰的是离线分析、批量处理、夜间评测这类活。
也就是说,越贴近用户的生意,越要硬吃涨价。
缓存命中率、请求编排、调用时间,从今往后都是成本变量,技术团队的活儿里多了一门新功课,掐表。
回头看 DeepSeek 这两年的路数,挺清晰的。
当初靠地板价杀出重围,直接把大模型 API 打成白菜价,逼得同行跟着降。
今年 5 月还把 V4-Pro 的 75%优惠转成长期价格,一副价格屠夫当到底的架势。
结果 8 月 13 日 V4-Pro 正式版上线,支持思考非思考两种模式,100 万 Tokens 上下文,最高 384K 输出,原生支持工具调用,参数配置拉满。
四天后,新价目表生效。
产品往上走,价格往上抬,两件事发生在同一周,这不是巧合。
价格战打到今天,大家心里都清楚,纯烧钱换规模的日子过去了。
模型能力拉不开代差的时候,拼谁便宜;能力站稳脚跟之后,就得拼谁能把生意做长久。
DeepSeek 从统一标价走到分时计价,等于宣告那个靠低价横扫市场的 1.0 阶段翻篇了,2.0 阶段拼的是精细化运营,拼算力调度,拼成本控制。
对咱们普通用户来说,网页端和 APP 该怎么用还怎么用,这轮调价影响的是 API 调用方。
但信号值得琢磨。
AI 服务的补贴红利期正在收尾,往后的免费午餐,会越来越像午餐,越来越不像免费。
开发者这边倒也有应对法子,能批量的夜里跑,能缓存的别重复问,该掐表的掐表。
凌晨一点的机房,Token 半价,算力管够,就是有点费程序员。
当年薅羊毛有多爽,如今补票就有多疼。
商业世界没有永恒的价格屠夫专业的股票配资官网,只有阶段性的话术。低价是敲门的砖头,门敲开了,砖头就该收起来了。
维度配资提示:文章来自网络,不代表本站观点。