中国开源模型三连击,梁文锋开最后一枪?
湛江小城走出的高考状元,背着算力闯进AI
1985年生于广东吴川教师家庭的梁文锋,少年时便展现出惊人的数学天赋。2002年以806分拿下湛江高考状元后,他放弃清华选择了浙江大学电子信息工程专业,理由简单直接:“AI是工程问题,不是数学题。”从2008年与同学徐进在宿舍用一台服务器跑出第一套量化模型开始,他就认定了用机器学习做交易的道路。2015年创立幻方量化后,他更是疯狂押注算力:2019年投入近2亿元研发“萤火一号”训练平台,搭载1100块GPU;2021年再砸10亿元升级“萤火二号”,配备万张英伟达A100,其算力号称匹敌4万台个人电脑。靠着这堆“萤火”,幻方资管规模从10亿元一路冲到千亿级别,跻身国内量化私募“四大天王”。但梁文锋的胃口远不止于赚钱。
两枪先声:DeepSeek V2价格战与V3成本革命
2023年5月,梁文锋做了一个让量化圈目瞪口呆的决定——宣布进军通用人工智能,成立“深度求索”(DeepSeek),首期投入30亿元,并立下三条铁律:“不融资、不上市、不商业化。”理由很直接:DeepSeek的目标是做世界顶级AGI研究机构,不是被资本节奏牵着的“卖铲人”。2024年5月,DeepSeek V2模型发布,凭借极低的推理成本瞬间引爆行业价格战,字节等大厂被迫降价跟进。梁文锋却淡然回应:“我们不是有意成为鲶鱼,只是不小心成了一条鲶鱼。”真正让硅谷感到寒意的是2024年12月26日发布的DeepSeek-V3。这个6710亿参数的混合专家模型,在多项基准测试中比肩GPT-4o,但训练成本仅557.6万美元,只用2048张英伟达H800、266.4万GPU小时——相比动辄数亿美元投入的闭源模型,这几乎是“降维打击”。
“不融资、不上市、不商业化”的叛逆者,为何选择开源?
在同行们纷纷追逐商业化应用时,DeepSeek是唯一一家至今未做toC应用、全面开源、甚至从未融资的公司。梁文锋的逻辑非常清晰:“在颠覆性技术面前,闭源形成的护城河是短暂的。即使OpenAI闭源,也无法阻止被别人赶超。”他将技术理想主义贯彻到底:“技术没有秘密,但重置需要时间和成本。英伟达的显卡理论上没有秘密,但重新组织团队以及追赶下一代技术都需要时间。”他鄙视只做复刻的路径,直言“只做复刻的话,成本很低,但做研究需要更多算力和实验”。而研究经费从哪里来?幻方作为出资人提供了充足的研发预算,梁文锋甚至表示“每年有几个亿的捐款预算,如果需要,也可以做些调整”。这种将“是非观”置于“利害观”之前的姿态,让DeepSeek成为了中国科技界最稀缺的声音。
最后一枪:200亿自掏腰包,500亿融资与终极赌局
2026年6月15日,一张19岁梁文锋胸戴大红花、穿红短袖的湛江高考状元照片突然刷爆全网。同一天,更重磅的消息传出:DeepSeek即将完成500亿元首轮融资,估值飙至3500亿—4000亿元,刷新国产大模型单轮融资纪录。腾讯出资100亿、宁德时代50亿,网易、京东、国家大基金悉数入局。而创始人梁文锋个人出资200亿元,牢牢控股不松手。这个曾经发誓“不融资”的叛逆者,在关键时刻选择了用真金白银为自己的信仰加注。高考状元、AI独角兽掌舵人、自掏200亿守股权——三个标签贴在同一个人身上,确实足够刺激。
开源没有秘密,但重置需要时间:中国AI的原创式创新
DeepSeek的崛起并非偶然。其V3模型的关键训练架构MLA源于一位年轻研究员的个人兴趣,经过研判后迅速组建专项团队攻关;R1模型果断调整强化学习路线,领先同类实现近似o1的推理能力,核心原因正是青年团队对前沿技术的敏锐嗅觉。梁文锋曾说:“我们创新缺少的不是资本,而是信心,以及组织高密度人才的能力,调动他们高效地进行创造力与好奇心驱动的创新。”这种扁平化、鼓励自下而上的组织机制,让他看到了皮克斯动画工作室的影子。在别国以为“中国更擅长从1到10的应用创新”时,DeepSeek用行动证明:后发者也有机会凭借技术创新和成本革命打破大模型竞争的传统逻辑。正如梁文锋所言:“中国要逐步成为贡献者,而不是一直‘搭便车’。”