三个月价格腰斩,大模型的“聪明”正在贬值?

据AI行业数据监测机构Silicon Data发布的LLM Token支出指数显示,2026年8月单月大模型Token平均支付价格暴跌29%,跌至0.97美元/百万Token,首次跌破1美元关口。回溯今年5月,该指数仍在2美元以上高位,短短三个月,市场就经历了一次彻头彻尾的“价格腰斩”。

三个月价格腰斩,大模型的“聪明”正在贬值?

三个月Token均价腰斩,价格通缩与能力升级并行

一个“平均支付价格”的下跌,来源无外乎两种解释:要么是全行业普降,要么是调用结构集体涌向便宜模型。而在各家大模型API平台用户量水涨船高、Token消耗量暴增的背景下,答案是两者正在同时发生。
当前行业呈现出明显的“剪刀差”特征:AI模型能力持续通胀,新模型跑分、功能迭代速度不断加快,但Token价格却在通缩式下跌。这背后是明确的增长叙事:只有抢夺足够多的用户,大模型公司才能持续撑起资本市场的增长预期。为此,给模型砍缓存成本、降低定价、推Flash模型,从可选动作变成了厂商的必要竞争手段。而用户也在“用脚投票”,为自己的AI应用选择更有性价比的模型服务。

从非旗舰到旗舰,OpenAI一个月连砍两刀降价

价格战的烈度正在层层升级,OpenAI的降价路径就是典型样本。7月30日,OpenAI首先对非旗舰产品线动手,宣布GPT-5.6 Luna永久降价80%,同系列Terra也降价20%;不到一个月时间,又把屠刀伸向刚发布的旗舰模型GPT-5.6 Sol,输入价格降价20%,输出价格降价1/3,一个月内两轮降价,从边缘产品覆盖到核心旗舰。
除了直接下调官方定价,厂商们也玩起了变相降价的“花活”:将API接入自家或者其他编程、办公产品,推出限时5折、两周免费试用、赠送额度重置等优惠,名义上价格未动,但本质上都是变相打折,吸引用户用自家模型跑任务。
国内厂商的价格战同样激烈,今年5月DeepSeek曾宣布将DeepSeek V4 Pro价格永久下调75%,调整后输入(缓存命中)价格为0.025元/百万tokens,输出为6元/百万Tokens。虽然后来因成本压力