DeepSeek工程师发文引热议,算子天才也在思考“转业”

“AI成了算子大师。”DeepSeek MLSys工程师刘胜与在最新发布的长文中给出了一个明确的时间预判:未来半年到一年内,AI自主评估调度方案、设计并实现端到端极致算子的能力,将大概率追平甚至超越顶级人类工程师。他给出了具象的对照:AI能一秒思考300个token,二十秒写完一份代码,“而我不行”。

刘胜与曾亲手交付DeepSeek V4.1模型的主Attention算子,这项成果本是他职业生涯的高光时刻,但他却在文中直言,这份骄傲背后藏着挥之不去的隐忧:自己每优化一行算子代码,都在缩短这门手艺的寿命。

DeepSeek工程师发文引热议,算子天才也在思考“转业”

北大图灵班工程师发长文:《我不得不把才华埋葬在昨天》

这篇三千字长文发布后迅速在技术社区扩散,甚至刷屏海外科技圈。刘胜与在文中揭示了自己所称的“技术悖论”:算子工程师的工作越出色,模型训练与推理效率越高,模型迭代速度就越快,AI自主编写算子的能力成熟得就越早,而自身被替代的周期也就越短。
他坦承,自己发布文章的目的并非表达失业焦虑,更不是刻意对比不同AI公司的路线,只是单纯想和自己过去手写算子的那段时光好好告别。随后他也补充说明,文中观点仅代表个人立场,与DeepSeek公司无关。正如他所写:“那份坐在工位上静心写上一下午算子的清欢,可能会在这个夏天成为绝唱。”

从“算子仙人”到“机甲驾驶员”:他的职业转向与核心逻辑

公开履历显示,刘胜与是北京大学2021级图灵班成员,本科就读于信息与计算科学专业,曾任北大未名超算队队长,带队征战国际大学生超算竞赛SC23拿下全球第二名,在校期间就已深耕GPU底层编程与大模型推理框架研发。2025年4月他加入DeepSeek任MLSys工程师,先后深度参与DeepGEMM的FP8极致性能GEMM算子优化、DeepEP V2通信算子重构,直到2026年9月独立完成DeepSeek V4.1主Attention算子的交付,被DeepSeek harness团队负责人崔添翼评价为“算子仙人”。
对于外界关注的“转业”定义,刘胜与明确表示并非完全跨行,而是从深耕多年的算子设计、编写、优化领域,转向做Agent的“机甲驾驶员”——依靠自身对底层硬件架构、上层模型需求和工程学的理解,驾驭AI工具完成算子开发工作。他坦言,过去自己的兴趣、擅长能力与工业界需求基本对齐,如今AI让自己擅长的事变成了它更擅长的事,工业界需求也从“会写高性能算子的人”漂移到了“能用AI更快地产出高性能算子的人”。他并不质疑自己仍能胜任新方向的工作,但“被夺走热爱的感觉,确实不太好受”。他用织毛衣的比喻形容这种失落:一个精通织毛衣的手艺人,靠手艺和意趣为生,直到机器能自动织出同样质量的毛衣,饭碗可以保住,但临窗听雨、引针穿线的意趣,终究被机器的轰鸣碾碎了。

全球AI建造者的集体思考:从个体焦虑到行业逻辑重构

刘胜与的思考并非孤例,目前这类关于AI替代的议题正在全球AI研发圈兴起。路透社近期报道提到,Anthropic的研究人员也公开发出警示,称持续变强的AI模型有可能挣脱人类管控,极端情况下甚至威胁人类存续,发出警告的人同样都是AI能力的直接建造者。
但与海外部分研究者强调的“生存性威胁”极端恐慌不同,刘胜与的表述更加纯粹与真实:他既不否认AI的替代趋势,也不陷入恐慌,更没有站在道德高地批判技术迭代,只是像一个跑完测试的工程师,平静报出结果。他坚信最前沿的智能应该以开放、廉价的方式供应给所有人,认为让闭源公司垄断最先进AI的严重性,不亚于让极端势力先于盟军掌握武器,“DeepSeek研究强大、快速、普惠的人工智能并将其开源,或许能把世界从2077那端拉回来一些”。

“技术悖论”背后:手艺消亡与算力军备的必然趋势

在很长一段时间里,GPU底层算子优化都被认为是人类程序员最难被取代的领域之一:这项工作不像上层应用开发有丰富的文档和工具链,更像一门依赖长期经验与直觉的隐性手艺,从业者需要深入PTX汇编和SASS机器