刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白

大模型狂飙的当下,宏观叙事往往要么是创始人喊出颠覆行业的狂言,要么是渲染AI威胁的末日论调,鲜少有人将目光投向AI能力最底层的建造者——那些用代码打磨算子、推高模型性能上限的工程师的真实处境。而近日DeepSeek机器学习系统(MLSys)工程师刘胜与的一篇深夜长文,恰好撕开了这层被忽视的帷幕。

刚交付DeepSeek V4.1核心算子 工程师发长文自曝将“转业”

刘胜与是2021级北京大学图灵班成员,曾任北京大学未名超算队队长,曾代表学校出征国际大学生超算竞赛SC23,在校期间就深耕Transformer底层架构与CUDA编程,加入DeepSeek后迅速成为底层基础设施与高性能算子优化的核心主力,刚刚为DeepSeek V4.1交付了核心算子,属于业内公认的顶尖算子工程师。就是这样一位亲手铸造AI引擎核心组件的人,却在个人平台发布了长文《我不得不把才华埋葬在昨天》,公开了自己即将“转业”的消息。不同于常见的失业焦虑,他的“转业”是主动预判自己即将被AI替代后的选择,相关长文发布后迅速在技术圈引发热议,不少人直呼“亲手造引擎的人先被引擎替代,比所有末日论都更有冲击力”。

亲手极致优化算子反而加速被替代?技术悖论戳中行业痛点

刘胜与在文中直白地对比了人类与AI在算子开发上的差距:“AI能一秒思考300个token、半秒敲出一行命令、二十秒写完一份代码,而我不行;AI能在模型深度、思考强度、工具调用量、甚至并行度等方面都能不断提升,而我不能。”随之而来的,是摆在所有底层算子工程师面前的残酷技术悖论:工程师把底层算子优化得越极致,模型的训练与推理效率就越高,模型迭代进化的速度就越快,而工程师被模型超越和替代的周期也就越短。
他坦言自己坚持做算子优化的动力来自两部分:一方面是纯粹的技术多巴胺,发明新技术、看到算子性能飙升、甚至跑赢芯片大厂官方算子的那一刻,成就感不亚于速通玩家打破游戏世界纪录;另一方面则是对技术大势的清醒认知——哪怕自己停手甚至消极怠工,全球其他团队的模型依然会以加速度向前推进,最终毫无悬念地席卷整个行业。他写道:“我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己。”而选择留在DeepSeek的原因,则是看中团队“研究强大、快速、普惠的人工智能并将其开源”的方向,他相信这或许能把世界从技术垄断的负面方向拉回来一些。

长文引发技术圈地震 同行印证AI已攻入算子开发腹地

长文发布后,评论区迅速被同行的真实经历填满,刘胜与“AI将很快超越人类算子开发能力”的断言,得到了不少一线开发者的直接印证。有网友“葫芦”留言称,自己目前正是借助Codex进行国产芯片的Attention算子开发,“除了方案不能替我敲定之外,别的都可以帮助我完成,又快又好”。
更深层的讨论来自学术界,南京大学计算机学院某博导也下场评论:“我反正相信系统设计的品味是可以由RL有反馈信号的,就看什么时候大家摸清数据的构造和训练方法吧,那时候就真完犊子了。”这句带着冷幽默的论断,也揭露了系统工程的底层隐忧:如果连架构审美、权衡取舍这类依赖人类经验的工作,也能被强化学习的反馈信号全面渗透,人类工程师最后的“直觉护城河”或许也将很快消失。值得一提的是,就在此次事件发酵前不久,DeepSeek的R1模型刚在全球走红,市场此前普遍预期DeepSeek将开启新一轮融资,而刘胜与的深夜独白,也从另一个维度展现了这家AI明星公司的技术底色——即便站在行业浪潮之巅,底层的技术开发者依然面临着被时代裹挟的不确定性。

DeepSeek V4.1落地加速 底层开发者转型或成行业新课题

就在刘胜与发布长文的同时,DeepSeek官方也在加速推进V4.1能力的落地,其Harness官方桌面端即将就绪,用户可通过该端便捷使用V4.1 Flash版本,底层算子能力的持续迭代正在快速转化为可落地的产品体验。而刘胜与的“转业”选择,也给整个行业敲响了警钟:当AI能够自主完成大部分底层开发工作,人类开发者的价值锚点将走向何方?是转向更上层的需求理解、架构设计,还是彻底离开技术一线?这场由顶尖开发者掀起的“自我革命”讨论,或许才刚刚开始。