国产大模型把 API 价格打到地板价之后,我的账单发生了什么
两年里我经手的模型调用单价掉了九成多。省下的钱没有变成利润,而是变成了更多「以前不敢做的功能」。

先说一个数字:我手上这个项目,两年前每处理一万条文本要花三十块出头,
现在同样的量不到三块。两年掉了九成多。
价格掉成这样,最直接的结果不是「省钱」,而是以前根本不会做的功能,现在敢做了。
一、账单是怎么降下来的
我不太关心参数和榜单,只关心三件事:单价、延迟、稳定性。这三样过去两年的变化大概是:
| 两年前 | 现在 | |
|---|---|---|
| 长文本单价 | 高,得算着用 | 低到可以忽略 |
| 首字延迟 | 三四秒,用户会走 | 一秒内,感觉像在打字 |
| 稳定性 | 高峰期偶尔抽风 | 基本平稳,偶尔排队 |
真正推动变化的不是某一次发布,而是竞争。当同级别模型有五六家可选,
价格就变成最容易被拿来比较的那一项。

二、省下的钱去哪了
我的感受是:这笔钱没有落进口袋,而是变成了新的功能和新的复杂度。
- 以前只敢在「用户明确点按钮」时才调用,现在敢让它常驻在后台做整理;
- 以前只处理一小段,现在整篇丢进去,顺带做摘要、标签、校对;
- 以前只能服务几十个重度用户,现在所有用户都能用上。
问题也跟着来了。调用变便宜之后,没人再去算调用次数了,
结果就是某天发现日志里跑着一堆没人看的批处理任务,白花钱还占资源。
三、降价之后的新坑
说三个我自己踩过的:
1. 便宜不等于该用。
把两万条数据丢给模型做「情感分类」,花了钱、跑了四十分钟,
产出还不如一个三百行规则的脚本稳定。简单的判断就该用简单的工具。
2. 便宜会诱使人放弃缓存。
以前会认真做缓存和去重,现在「反正便宜」,重复请求直接发。
量一上来,该省的地方还是那些。
3. 单价降了,但上下文变长了。
很多人只盯着单价,忘了每次请求塞进去的内容本身也翻了几倍。
总成本是单价乘总量,只看一半会算错账。
四、对普通开发者意味着什么
我的结论有点反直觉:单价下降,真正的门槛反而变成了「你会不会用」。
模型已经便宜到可以随便调了,拉开差距的地方回到了最老的那几件事上——
需求拆得清不清楚、验收标准定没定、权限给得对不对。
这些东西跟模型贵不贵没有关系。
写在最后
价格战对用户当然是好事。但我越来越觉得,
当一样东西便宜到不用算计的时候,判断力就成了唯一的成本。
你那边用上大模型了吗?账单是涨了还是降了?