DeepSeek V4.1 Flash上线,崔添翼加入“义父之战”
9月11日,DeepSeek正式对外发布V4.1 Flash大模型,这款被官方定位为V4 Pro全面替代品的新模型一经上线便成为行业焦点。就在两天前DeepSeek刚完成V4.1 Flash中间版测试后,正式版本便火速上线,其性能、成本的双重升级直接改写了中小开源模型的性价比标准。
性能越级还降本,V4.1 Flash刷新中小模型性价比天花板
不同于行业“小模型必然性能妥协”的普遍认知,V4.1 Flash通过KV Cache压缩技术实现了软硬件协同优化:显存需求降至上一代的1/4,SSD存储需求降至1/8,社区实测输出速度可达300至500 tokens/秒,推理效率大幅提升。基准测试数据显示,其GPQA Diamond得分达90.9分,各项核心指标全面超越前代V4 Pro,真正实现了“更快、更省、更强”的三重升级。
崔添翼高调喊话“多认义父”,V4 Pro全面切换Flash服务
模型上线当日,科技博主崔添翼便在社交媒体公开宣布,后续V4 Pro的调用将全面切换到性能更高、速度更快的V4.1 Flash上,调用价格也将同步调整为Flash系列定价。他调侃称此前V4 Pro的价格是Flash的3倍,此次切换后自己又能在外卖里加俩鸡腿,看来要“多认一个赛博义父”,还配文吐槽月初大手大脚、月末吃土的打工人日常,直接将“义父之战”的梗推上行业热议榜单。
9月10日紧急调价,Flash系列最高降幅达60%
就在V4.1 Flash上线前一日,DeepSeek已率先下调Flash系列API价格:9月10日12:00起,闲时缓存命中输入定价0.02元/百万token、未命中1元、输出4元/百万token,高峰时段价格翻倍;对比此前0.05元/百万token的缓存命中价、1.5元/百万token的未命中价、4.5元/百万token的输出价,最高降幅达60%,直接击穿了行业价格底线。
国内大模型价格战白热化,“义父逻辑”成用户投票新标准
此次DeepSeek的降价并非孤立动作,而是应对国内大模型行业激烈竞争的直接选择。此前智谱发布的GLM-5.3-Flash以五折限时价杀入市场,输入价格仅为DeepSeek非高峰时段的27%,输出价格仅为31%,且评分还压制过DeepSeek V4 Pro,直接击穿了DeepSeek的价格防线。
不同于OpenAI、Anthropic等海外厂商拥有稳定订阅付费基本盘、可通过重置额度给开发者发“增量福利”的“恩赐派”逻辑,国内大模型厂商普遍没有稳定的订阅收入支撑,当前阶段仍处于抢用户、抢市场份额的竞争期,性价比成为争夺用户的核心筹码。崔添翼口中的“赛博义父”本质上是用户对高性价比AI服务的投票逻辑:哪家能给到更实惠的价格、更优质的服务,用户便愿意将调用需求倾斜向哪家。