Kimi冲上3300亿,揭秘杨植麟和他的万亿模型

K3空降,2.8万亿参数炸场

7月16日晚,WAIC开幕前夜,月之暗面突然发布Kimi K3,参数规模达2.8万亿,成为全球首款万亿级开源大模型。支持100万Token上下文,在多项测评中超越GPT-5.6和Fable 5。AI从业者评价:在全模态、长上下文、复杂任务场景中,K3在国内断层式领先。马斯克在X上点赞,并喊话Grok 4.5“有望超过Kimi”。K3发布后,英伟达等科技股承压,港股智谱、MiniMax单日大跌,华创证券指出K3是关键催化剂。

Kimi冲上3300亿,揭秘杨植麟和他的万亿模型

国产最贵定价:20倍于DeepSeek,值吗?

K3定价引发轩然大波:未缓存输入20元/百万Token,输出100元/百万Token,比DeepSeek V4 Pro贵20倍,是GPT-5.6 Sol的60%。月之暗面联合负责人黄震昕回应:“开源模型不该被贴上低价标签,我们做出了SOTA级模型,就该匹配合理定价。”部署K3需约20张H100显卡,成本高昂。但工程师测试发现,K3在复杂编程任务中返工率更低,一次通过率高于OpenAI,综合成本未必更高。业内人士认为,K3涨价释放信号:竞争从“低价”转向“能力定价”,同时瞄准海外市场,对海外用户具备竞争力。

杨植麟:从清华学霸到CMU“神级学生”

杨植麟本硕毕业于清华,90%专业课95分以上,编程课满分。在CMU读博时,导师Russ Salakhutdinov评价他是“最顶尖的学生之一”,用不到4年完成博士,兼顾研究、技术与底层编程。他提出的Transformer-XL和XLNet已成为AI模型理论基础,论文引用超2万次。毕业时,他坚持回国创业:“如果连试都不试一下,我会后悔的。”Russ称他既懂技术、又是出色的研究者,同时具备商业头脑,极其罕见。月暗前员工透露,杨植麟靠“整锅端”实验室的人才引进方式,保持团队领先。

为长程复杂任务而生:开源与商业双重破局

K3核心创新在于KDA混合线性注意力机制和注意力残差架构,百万上下文解码速度快6.3倍,训练效率提升25%。K3将对话式AI推向项目式AI,可一次性完成跨文件工程级修改,前端视觉完成度远超其他模型。Russ盛赞K3开源将“深刻改变AI格局”,尽管开源让竞争对手可以研究、蒸馏模型,但长远看,通过蒸馏可降低运行成本。黄震昕表示,Kimi坚持开源,核心技术与论文均公开。K3发布后,月暗估值飙升至500亿美元,计划8月启动最后一轮融资,最快6个月内登陆港股。

道阻且长:Kimi的“两线作战”与未来野望

Kimi同时面对模型军备竞赛和用户习惯迁移的双重成本。其C端用户曾因投流月活达3600万,后因停止投放跌至不足千万。海外收入主要来自被集成进第三方应用,用户和入口不掌握在自己手中。但K3发布后,月暗迅速调整:拆分付费产品线,优先保障付费用户,宁可放弃新增收入。黄震昕透露,Kimi参数规模还会持续向上拓展,不会止步于2.8万亿。Russ预判,未来Kimi会像GPT一样做分层模型体系,大模型负责前沿,小模型服务于高效场景。杨植麟信奉“问题不可避免,但问题都可解决”,他正站在从技术天才到企业家的最难考题面前。