大模型Token定价权之争白热化:未来更贵还是更便宜?
8月17日,DeepSeek 给 V4-Pro 换了新价。高峰时段的输出价从每百万 token 6 元跳到 27 元,涨了 3.5 倍,还第 一次用上了峰谷定价:人少的时候半价,人多的时候原价。就在这条公告生效的同一周,OpenAI 把 GPT-5.6 的入门款 Luna 输入价砍掉了八成,输出价也大幅下探。
同一个 8 月,一个往上抬、一个往下沉。大模型的价格,第 一次出现了方向相反的两条线。
同一个 8 月,有人涨有人降
DeepSeek 曾是开发者口里"性价比"的代名词。它靠低价把一大批中小团队接了进来。这次调价,是它第 一次把价格往上拉,而且拉得很陡。
OpenAI 的动作刚好相反。GPT-5.6 的入门款 Luna 把输入价压到接近地板,明显是想把价格敏感的用户和轻度使用者圈进来。
一个把高负载时段卖贵,一个把低门槛入口卖便宜。两边都在争同一批人:既想要便宜的,也想要能付得起高价的。
有意思的是,涨价并没有把人劝退。OpenRouter 的周榜显示,DeepSeek V4-Flash 单周调用量冲到 7.22 万亿 token,占到全球近六成,8 月初还一度因为访问量太大出现容量不足。也就是说,即便开始收紧价格,用户先用惯了的惯性还在。
国内集体涨价:从抢用户到卖能力
DeepSeek 不是孤例。今年上半年,国内大模型出现了一轮集体涨价。
智谱在一季度把 API 调用定价累计上调 83%,公司 CEO 张鹏在业绩说明会上说,价格提了,调用量反而还涨了四倍。月之暗面的 Kimi K3 输出价站上每百万 token 100 元,比上一代贵出两三倍。腾讯混元部分接口涨幅超过 5 倍,最高单项涨了 463%。豆包专业版在 6 月改成三级阶梯定价,按月收 68 元、200 元、500 元。
把这些动作连起来看,趋势很清楚:中国大模型的平均 API 输出价,已经从 2025 年一季度的每百万 token 约 12.2 元,回到了今年二季度的 21.9 元。
摩根士丹利 8 月的一份研报算过,中国大模型的输入、输出均价较去年分别涨了约 48% 和 80%。高盛的判断更直接:需求旺、算力紧,行业正从激进的价格战回到理性定价。
过去两年比的是谁更便宜,现在比的,是谁手里有别人替代不了的能力。
海外反向:旗舰还在贵,入门已打到地板
把镜头转到海外,方向是反的。
OpenAI 称,GPT-5 相比 GPT-4 每 token 价格累计降了约 97%。Gemini 3.7 Flash 限时半价,Anthropic 一次把 Claude 价格降了约 67%。
但便宜只发生在"基础层"。在旗舰层,溢价正在被重新建起来。GPT-5.6 的 Sol 版本输入回到每百万 token 5 美元,输出 30 美元,是入门款的几十倍。
换句话说,海外厂商也在分两层走:把入门能力当基础设施,用低价铺量;把顶尖能力当稀缺品,用高价守住利润。
这和国内的逻辑并不矛盾。两边都在做同一件事,只是起点不同:国内是从低价往上抬,海外是从高价往下压,最终都收拢到一个"分层"的结构里。
单价在跌,账单在涨:算力的两本账
最容易被忽略的一组对照,藏在成本里。
上游的算力还在涨。一年期 H100 的合同价,从去年 10 月每卡每小时 1.7 美元,涨到今年 3 月的 2.35 美元,涨了近四成;GPU 云租赁价格一年涨了四成到九成四。HBM 存储半年市价涨了五倍多。
下游的单位 token 成本却在降。推理成本降了约 39%,训练降了约 32%。梁文锋署名的 DSpark 论文里有一个长周期数据:2017 年每百万字符调用约 20 美元,到 2026 年降到 2 美元以下,降幅超过九成。
一升一降之间,出现了一道"价格剪刀差"。算力贵了,但单位智能便宜了。浙商资产配置的一份报告,把这组反向数据并列放到了一起。
所以会出现一个反直觉的画面:单看每 token 的单价,模型越来越便宜;看企业月底的账单,钱却花得越来越多。因为用的人多了、用的场景深了,总量把单价拉出来的空间又填了回去。
价格地板在降,账单在升。
未来不会只有一个答案
回到开头那个问题:未来更贵还是更便宜?答案可能不是一个。
基础推理会像水电一样便宜。当技术迭代和规模效应把边际成本压到极低,基础能力的定价会一步步接近公用事业。证券日报曾引述艾媒 CEO 张毅的判断,基础推理服务价格因技术迭代和规模效应持续下探,正逐步接近水电那样的定价。
高端智能会越来越贵。能解决难问题、能替代高价值岗位的能力,供给有限,需求刚性,价格有支撑。
两种定价逻辑正在同时成立。一派锚定稀缺性做高溢价,一派定位普惠基础设施靠规模取胜。
定价权,正在从"谁便宜"转到"谁稀缺"。
当单价趋近零,厂商真正要守的护城河,就不再是价格,而是别人抄不走的那部分能力。真正难的不是把 token 卖便宜,是让贵的那部分,用户还愿意付。