DeepSeek涨价、OpenRouter卖身:API行业正在重新定规则

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

今天发生两件事。

一件是DeepSeek新价格正式生效。V4-Pro输出从6元涨到27元/百万Token,缓存命中输入从0.025元涨到0.3元。如果你之前拿DeepSeek当免费水用,现在水表开始走了。

另一件是Stripe收购OpenRouter的消息基本落定,70多亿美元。三个月前这家公司的估值还是13亿,翻了五倍。

两件事本身没什么关系,但放在同一天看,信号很明确:API这个行业正在重新定规则。

先说DeepSeek。

这次涨价不是"一刀切",而是按时间段定价:工作日9-12点、14-18点是高峰,价格翻倍,其他时间半价。用过峰谷电的人对这个模式不陌生——就是把"什么时候用"和"花多少钱"绑在一起。

一个叫"人工大黑"的开发者贴了张账单。他8月8号用了7673万Token,98%是缓存命中输入,按老价格花了2.99元。按新价格,同样的量要7.27元。还没到用不起的程度,但意思到了——成本翻倍了。

而且大概率不是个例。OpenAI Luna降价80%是防守不是真降,Anthropic Sonnet 5月底也要回调50%。厂商们正在把价格当成一种调节工具,而不是长期承诺。

再说OpenRouter。

Stripe不是模型公司,也不是云厂商,它是做支付的。花70亿买一个API路由平台,买的不是技术,是"所有AI调用都要经过一个计费出口"这件事。

OpenRouter现在月处理200万亿Token、年收入1.4亿美元、毛利率接近70%。这不是软件公司的利润,这是基础设施的过路费。

两件事叠在一起,结论很清楚:

模型本身赚的是辛苦钱,做分发和计费的才是稳赚不赔的。

那开发者现在能做什么?

方向其实已经有人跑通了。

NVIDIA开源的NeMo Switchyard测过一组数据:145个Agent任务里,只有7%真正需要Claude Opus这种旗舰模型,其他93%交给小模型就能完成,成本降了74%。

这不是概念,是已经能落地的东西。

Reddit上也有实例:一个团队月费288美元全走一个模型,改成多模型路由后,85%的调用走便宜模型,月费降到60美元。

三件事可以立刻动手

对个人开发者来说,现在还不需要搭一套完整的路由系统,但有几件事可以开始做:

第一,看账单。你每月的Token消耗里,有多少是真正需要旗舰模型的?格式化JSON、摘要、简单问答,完全可以用更便宜的模型跑。

第二,把定时任务挪到晚上。DeepSeek闲时价格是高峰的一半,改个CRON表达式就能省一半钱。

第三,用缓存。长上下文Agent里重复读取历史对话、工具结果的地方,用缓存可以省下大量重复计算的成本。

如果你不想自己搭路由,也有现成的方案。像EasyAPI就是把路由、缓存、配额管理打包成一层网关,一个接口接进去就能在多模型之间做调度。省下来的时间比省下来的钱更值钱。

最后说一句:今天不是AI变贵的开始,是低价补贴结束的开始。

对会算账的团队来说,这个阶段反而是机会。模型能力在拉平,但调用效率、成本控制、调度能力会变成新的护城河。

AI 时代程序员必备技能

Codex、Claude Code、Cursor、Hermes Agent、OpenClaw等工程化实战专栏 ,讲透 AI 如何接管脏活累活

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值