峰谷定价生效后,我学会了算大模型这笔账

早上九点,同事在群里发了张账单截图:V4 Pro 缓存命中输入从两分五涨到三毛,第一反应是计费系统出了 bug。查了一圈才发现,不是 bug,是 8 月 17 日零点正式生效的峰谷定价。

涨的不是单价,是"结构"

先说数字。DeepSeek V4 Pro 高峰时段(9点到12点、14点到18点)缓存未命中输入 9 元/百万 Token,输出 27 元,缓存命中输入 0.3 元;空闲时段全部减半。对照调价前的 3 元、6 元、0.025 元,缓存命中输入高峰价涨了 11 倍。注意涨得最狠的两项——高峰时段和缓存未命中,恰好是白天算力最紧张、成本最高的两种场景。
官方说这是用价格杠杆引导错峰,让非紧急任务挪到夜里跑,把 GPU 集群利用率拉平。仔细看价目表,这个逻辑是自洽的:缓存命中输入只要 0.3 元,是未命中的三十分之一,等于明着告诉你"多复用上下文"。同一天上线的 V4-Pro-0813 把上下文拉到 100 万 Token、输出最高 384K,还原生兼容 Anthropic API——功能往上走的同时,计费结构也跟着变了。

整个行业都在从"卷单价"转向"卷结构"

这不只是 DeepSeek 一家的事。钛媒体今天的分析把趋势讲得很清楚:大模型 API 定价正在告别"一刀切降价",转向更细的计费工具——分时段价格、缓存感知折扣、模型分层,甚至有人开始试按结果付费。
两边的动作能对上。OpenAI 一边把 Luna 砍价 80% 去抢轻量级市场,一边让旗舰 Sol 维持原价不动;国产模型这边,小米 MiMo-V2.5 以 32.8T tokens 登顶 OpenRouter 月度调用榜,前七名全是国产,前十名里国产模型占了 88.1% 的调用量。价格战没有结束,只是从拼单价变成拼"哪一档模型、什么时候调、怎么计费"。

对个人开发者,省钱的方式得换

过去省钱是挑便宜的模型,现在省钱是挑对的时段、对的缓存策略。我这几天的实测是:把非实时的批处理任务丢到空闲时段,账面上直接少一半;多轮对话把系统提示词和常用上下文固定复用,让请求尽量命中缓存,0.3 元和 9 元的差距比任何议价都管用;至于分类、摘要这类简单任务,用小模型就够了,旗舰留给真正复杂的问题。
只是这些策略靠人肉盯价目表不现实——价格表每周都在变,模型越来越多,手动改配置根本跟不上。这也是为什么网关类产品最近被反复提起:把路由、缓存、错峰做成策略而不是代码。

EasyAPI 这类把多模型调度和计费结构一起产品化的网关,正好是给这个新定价时代准备的。
峰谷定价只是个开始,算力有峰谷,账就有峰谷。谁先把"什么时候用、用哪个模型、怎么计费"想清楚,谁就能在价格战里少花冤枉钱。

需要的可以看看点击上面EasyAPI

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值