42页交流会实录背后:梁文锋没说的另一半故事
数学怪才到量化之王:梁文锋的“西蒙斯之路”
1985年生于广东湛江的梁文锋,初中就已自学微积分,后考入浙江大学。他的职业生涯起步于用AI算法选股,2013年创办雅克比投资公司,2015年与两位校友共同创立幻方量化,管理资产规模一度超过80亿美元,成为中国最大的量化基金之一。梁文锋深受文艺复兴科技公司创始人吉姆·西蒙斯影响,曾为《征服市场的人》中文版作序,写道“一定有办法对价格建模”。但与西蒙斯类似,梁文锋的道路并非一帆风顺——幻方量化曾因业绩不佳道歉,也曾因中国监管对量化交易的打压而陷入困境。不过,正是这段在数据中寻找“隐藏形态”的量化经历,为他后来进军AI积累了独特的技术眼光和“少即是多”的工程哲学。
工程师气质与开源文化:梁文锋的AI实验田
梁文锋更希望被看作工程师而非交易员。他事必躬亲,会和同事一起加班睡在办公室,改进算法使模型更智能。2019年,他的团队开始大规模使用英伟达GPU,到2022年ChatGPT发布时,幻方已拥有超过1万块高端英伟达芯片。梁文锋曾比喻购买芯片“就像家里买钢琴,一来买得起,二来是因为有一群急于在上面弹奏乐曲的人”。他主导的DeepSeek以开源为文化行为,认为“被追随是很有成就感的事”,并因此在全球AI社区赢得极高声誉。DeepSeek仅160名员工,却推出性能跻身全球前十的模型,甚至被外界称为“中国的阿尔特曼”或“中国的西蒙斯”。
10小时崩溃:不是模型不行,是“出口让人堵住了”
2026年3月29日晚至3月30日上午,DeepSeek网页和APP服务崩溃长达10小时。官方状态页显示,受影响组件并非全站,而是精确锁定为“Web Chat Service”——即用户从登录、鉴权、会话保持到上下文读写的整个入口链路。故障特征与模型推理资源紧张不同:用户无法登录、页面转圈、会话中断,典型特征是“模型没坏,它能思考,但DeepSeek说不出来话,因为出口让人堵住了”。事故发生流程通常是前端服务承载过量请求后,共享缓存、数据库连接池被占满,慢请求变成排队,用户反复刷新放大负载,最终系统自我加剧拥堵。而近期X平台流传DeepSeek已暗中上线V4模型(对外仍称V3),引来大量“围观式访问”——用户反复刷新、登录、测试输出风格变化,这类探测流量对入口系统的消耗甚至高于正常使用。
V4发布前的隐忧:从模型能力到交付能力的必修课
这已不是DeepSeek第一次因流量高峰掉链子。2025年1月其在美区App Store爆红后,服务器遭遇“大规模恶意攻击”,曾临时限制新用户注册。问题本质在于:模型发布带来关注,关注带来高峰,而网页和APP侧的服务稳定性频繁暴露短板。官方API文档目前主线仍是V3.2,V4虽传闻4月发布,但任何新模型的推出都将叠加更复杂的用户结构——正常日活、开发者测试、媒体关注、旧用户回流,以及无数围观者反复试探。对DeepSeek而言,下一代模型能力或许没问题,但“把模型能力稳定送到用户面前的能力”已成为必须补齐的短板。梁文锋这位“事必躬亲”的领导者,在春节假期结束后将重返岗位开发下一代模型,而留给他的解决时间正在倒计时。