智谱和MiniMax,进入“低价增长”时代
2026年9月DeepSeek发布V4.1 Flash模型再次下调API价格,将非高峰时段缓存命中输入的百万Token定价压至0.02元,直接掀起了国内大模型厂商的新一轮价格战,智谱、MiniMax等头部玩家正式进入“低价增长”时代。
DeepSeek带头砍价 缓存输入成降价核心阵地
目前国内主流大模型厂商的普通输入、输出价格已经相差不大,拉开价格差距的核心是缓存输入机制——即模型再次读取已经处理过的系统指令、历史对话或代码库时,收费远低于首次处理。以DeepSeek非高峰时段价格计算,首次处理100万Token收费1元,再次读取相同内容仅收0.02元,两者收入相差50倍。对模型公司而言,两次读取都产生了Token使用量,但收入却差距悬殊,如果大量调用来自低价Flash和缓存内容,API收入的增长速度将远低于Token使用量的增长速度。
此前只有旗舰模型才能完成的高价值任务,如今已经被Flash模型压到低价区间,模型厂商刚刚建立的能力溢价,很快成了全行业的公开报价。
智谱MiniMax高增长背后 收入已被低价稀释
这让智谱此前宣传的“Token增长40倍”有了另一种解读:即便客户没有离开智谱,只是从GLM-5.3切换到价格仅为十分之一的Flash模型,同样数量的Token能带来的收入也大幅缩水。更何况竞争对手同样提供低价替代产品,且模型API接口相对标准,智谱、MiniMax、DeepSeek、阿里云均提供OpenAI兼容接口,开发者仅需更换API密钥和基础地址,再测试准确率、速度和稳定性即可完成迁移,无需重建整套应用,技术边界已经越来越低。
资本市场的反应最为直接:9月杰富瑞将智谱API业务的ARR倍数由50倍降至30倍,即便上调收入预测的华泰证券,也将智谱2029年市销率由27倍降至20倍。估值倍数的连续下调,正是市场在缩短愿意预付溢价的时间。智谱上市时的高估值曾包含三重期待:港股稀缺的纯大模型标的、海外模型受限背景下的国产替代选择、单代模型领先带来的定价权,但半年后这三重期待都已不再稀缺——更多独立模型公司传出上市计划,DeepSeek、Kimi、千问、腾讯、MiniMax等玩家都能满足部分国产模型需求,新一轮Flash价格战更是压短了最后一层溢价,模型的领先窗口可能仅维持几个月甚至更短,产品优势越来越难直接换算为长期定价权。
大厂靠生态扛价格冲击 独立玩家只能下场抢用户
不同于大厂拥有算力、云平台和分发渠道,可以把模型作为生态的一部分分摊成本,独立模型公司必须证明自己不仅能把模型做出来,还能在价格持续下降的环境中保住客户、扩大调用量、改善利润率。
如今大模型厂商的商业化逻辑已经发生明显变化:过去天天对外宣讲模型能力提升、Benchmark成绩、参数规模、推理能力,现在越来越像成熟的互联网公司——开旗舰店、做套餐、搞优惠、送Token、进创业园、做线下推广。智谱开设天猫官方旗舰店后,48小时内品牌搜索量环比增长50倍,同时带动淘宝天猫AI Token等订阅类产品成交环比增长超过160%;多地创业园也将传统的房租、工位补贴换成Token补贴,因为对AI创业者和小团队而言,Token已经成为日常生产成本,写代码、做PPT、跑Agent、分析数据都在消耗Token,大模型已经成为企业成本结构中的新增项。
抢“默认模型”成新共识 行业进入用户留存淘汰赛
如果只是政府给创业者发AI福利,这件事并不特殊,真正值得关注的是模型厂商也在主动出击:智谱专门针对杭州市场推出GLM Coding Plan相关活动,把目标瞄准开发者和AI Coding用户,和各地创业园、政策补贴抢创业者。
如今模型厂商已经意识到,当模型能力达到一定阈值后,最终要回答最朴素的问题:用户为什么要用你的?模型能力、价格、生态、用户习惯养成都是核心因素。这也是为什么看似“土气”的地推、拉新、留存、转化等互联网玩法,开始成为大模型商业化的核心手段——先把用户抢过来,形成使用习惯,再谈后续的商业化。模型行业的增长正在变得更便宜,过去靠技术能力获得高定价的模式已经失效,低价增长时代的竞争,本质上已经变成了用户规模和生态占有的争夺。