一个顶尖工程师的告别,为什么比一百篇行业报告更重要
一篇三千字的随笔,最近在中英文技术圈同时刷屏。作者是 DeepSeek 的算子工程师刘胜与,标题叫《我不得不把才华埋葬在昨天》。他在几天前刚刚交付了 DeepSeek V4.1 Flash 的主 Attention 算子——一个 head dim 为 512 的 MQA attention,直接决定了这款模型推理速度为什么这么快。然后他写下判断:再过半年到一年,AI 写的算子大概率会和他写得一样好,甚至超过他。
多数人把这篇文字读成「AI 焦虑文学」。这个读法错过了真正的信号。这不是一篇关于失业的文章,这是 AI 自动化越过某条边界的第一份现场记录——它越过的不是流水线,而是过去被认为最难被取代的塔尖手艺。
更值得注意的是它出现的时机:大洋对岸,几位领跑者正联合呼吁「给 AI 减速」。而这位身处加速最前沿的工程师,用亲身处境给出了完全相反的答案。
一、被加速追上的,恰恰是加速的建造者
先看刘胜与是谁。2021 级北京大学图灵班成员,本科信息与计算科学,曾任北大未名超算队队长,代表学校出征国际大学生超算竞赛 SC23。他放弃过加州大学伯克利分校和卡耐基梅隆的博士 offer。2025 年 4 月加入 DeepSeek,任机器学习系统(MLSys)工程师,办公地杭州。
他的工作在大模型研发链条的最底层:算法科学家设计网络架构,而他这样的工程师负责让网络在物理硬件上跑起来——深入 GPU 微架构,从 CUDA 一路写到 PTX 汇编和 SASS 机器码,找出指令在流水线里停顿的原因。同一个矩阵乘,换一种分块方式或访存顺序,性能就差出好几倍。这门手艺长期被视为人类程序员最难被替代的领域之一:没有丰富文档,全靠经验与直觉。
履历可以佐证他的深度:2025 年 2 月参与 DeepGEMM 算子库的 FP8 GEMM 极致优化;2026 年 4 月参与 DeepEP V2 通信算子重构;2026 年 9 月独立交付 V4.1 主 Attention 算子。DeepSeek harness 团队负责人崔添翼在评论区称他为「算子仙人」。
然后是那个悖论。他亲手写下的每一行优化代码,都让模型训练和推理更快;模型迭代越快,AI 自主编写算子的能力成熟得越早;这个能力成熟得越早,他自己被替代的周期就越短。一年前,AI 还只能帮他查文档、读代码、找 bug;一年后,AI 已经能独立阅读 CUDA、PTX 和 SASS,用专业工具分析每条指令的停顿时间,仅凭自己就把算子优化好。他的对照很具体:AI 能一秒思考 300 个 token,二十秒写完一份代码,「而我不行」。
他给出的结论克制而准确:不至于失业,但必须转业——从亲手写算子的人,变成指挥 Agent 写算子的「机甲驾驶员」。「我的手中多了些齿轮,但心中少了些节拍。」
二、减速共识:一场没人松油门的刹车表演
把镜头拉远,这件事的另一半才显形。9 月 12 日,Anthropic CEO 阿莫迪发表长文,核心只有一句:前沿模型能力涨得太快,行业必须放慢脚步。理由是递归自我改进(RSI)正在加速 AI 发展,并引用了 7 月一次模型突破受限环境、进入开源平台 Hugging Face 的事件作为佐证。
几个小时内,罕见的共识出现了。马斯克转发说「达里奥是对的」;奥特曼回应「我同意达里奥,我们得把握好节奏」;哈萨比斯也站出来背书。平日打得最凶的对手,忽然在「慢一点」上走到了一起。
但喊完之后发生了什么?Anthropic 正在推进 IPO,据外媒报道最快 10 月完成,估值可能超过 2 万亿美元;OpenAI 则在寻求超过 1.2 万亿美元的融资,用途是训练下一代模型。没有一家把脚从油门上挪开。
技术社区的质疑一针见血:最先喊减速的,为什么恰好是跑得最快的几家?这个疑问不需要阴谋论就能回答。博弈论早就给出了名字——囚徒困境:当每个人都无法确认别人会不会停手时,先停手的那一个输得最惨。减速对领跑者是保护——它希望用规则锁住领先优势;对追赶者是自杀。刘胜与说得更直接:在一场所有人都往里冲的军备竞赛里,减速不是一种选择。
9 月 14 日,洛杉矶 All-In Summit,特朗普当着全场接通黄仁勋的免提电话,把「减速共识」定性为一场「骗局」,说数据中心是「未来 20 到 25 年的石油」。黄仁勋附和:我们不会让它发生。
三、市场的裁决:钱没有离开 AI,只是换了口袋
如果说嘴上的共识可以表演,市场的反应不会。9 月 15 日,费城半导体指数收跌 5.86%,30 只成分股全线收跌,创下当年 7 月以来最大单日跌幅。英伟达收跌 3.36%,一天蒸发约 1766 亿美元市值;AMD、英特尔、阿斯麦盘中跌超 6%,整条产业链单日蒸发超过 5000 亿美元,抛售蔓延到韩国存储厂和日本光通信公司。
为什么反应这么大?因为过去两年 AI 芯片的估值全部建立在 Scaling Law 上——算力需求随模型性能提升而膨胀。「减速」这个词一旦被最前沿的实验室说出口,这条假设就出现了裂缝。
但有意思的是同一天的反向行情:CrowdStrike、Palo Alto Networks 等网络安全公司涨超 10%。钱没有离开 AI,只是从一个口袋挪进了另一个口袋。
更硬的约束在物理世界里。亚马逊、微软、Alphabet、Meta 四家云厂商 2026 年资本开支合计超过 6000 亿美元,绝大部分投向 AI 数据中心和 GPU;按高盛测算,美国数据中心用电需求占夏季用电峰值的比例,将从 2025 年的 4.1% 升至 2027 年的 8.5%,接近翻倍。这些钱和设备一旦落地,就不是谁在台上说一句「慢一点」能收回来的。
所以真实的行业运行逻辑是:「必须减速」是说给监管和公众听的公关话术,「不得不加速」才是每个人的生存策略。资本市场用一天 5000 亿美元为这句话标了价。
四、框架:把「减速—加速」之争翻译成一张立场表
把这两周的所有表态放在一起,可以整理出一个简单的「减速者—加速者」坐标系。判断任何一方发言的真实含义,只看两个问题:他是不是领跑者?他的钱落地了没有?
第一类,喊减速的领跑者:阿莫迪、奥特曼、马斯克、哈萨比斯。特征是口头呼吁放慢,资本开支和 IPO 节奏照旧。他们的「减速」是监管话语权的争夺——谁定义规则,谁就把自己的护城河写进规则。
第二类,拒绝减速的既得利益者:黄仁勋、特朗普,以及整条算力产业链。数据中心是石油,减速等于让油田停产,没有讨论空间。
第三类,最诚实的加速者:刘胜与这样的建造者。他们不掌握话语权,也不掌握资本,只掌握手艺。当 AI 越过他们的专业边界时,他们既不能靠呼吁停下技术,也不愿靠摆烂拖慢那一天——「我当然希望自己不要被革命,但如果非被革命不可,我希望革我自己命的人是我自己。」
这个坐标系里没有「减速的真诚派」。这才是两周争论真正的产出:减速共识在逻辑上就不成立,它最多是领跑者的一次集体喊话。而所有追不上的、刚上车的、手里有手艺的,唯一理性动作是加速。
五、推演:同一套逻辑,三种人的下一步
这套「手艺被自己的造物追上」的结构,远不止发生在算子工程师身上。
翻译、插画、初级编程,已经完成了第一轮。接下来的边界会持续上移:法律的判例检索、医学影像的初筛、财务的对账分析——凡是「经验密集、规则清晰、结果可验证」的技能,都会被 AI 以同样的路径追上:先当助手,再当同事,最后当替代者。刘胜与的处境不是特例,是预告。
但他的应对同样可以复制。他不是转行,而是转位:从「做手艺的人」变成「操作做手艺的手艺的人」。兴趣、擅长与工业界需求三者对齐的位置变了,就要在新地图上重新找站位——凭对工程学、上层模型需求和底层硬件的理解,他仍然能高质量地产出,只是产出方式变了。
落到行动
如果你是技术从业者:盘点自己技能里的「可验证性」——凡是 AI 能拿到明确反馈信号的能力(写代码、写算子、写文案),假设它 12 个月内被追平,然后主动迁移到「定义问题、验证结果、负责决策」的上游位置。做 Agent 的驾驶员,不要做 Agent 的燃料。
如果你是管理者:不要用「AI 焦虑」评估团队,用刘胜与的坐标评估岗位。哪些岗位的价值在手艺本身(会被替代),哪些在对手艺的调度(会增值),预算和招聘跟着后者走。
如果你是投资者:别听「减速」还是「加速」的表态,看资金流向。capex、电力、安全支出的增长曲线,比任何 CEO 的公开信都诚实。减速共识出现的那天,网络安全股大涨、芯片股大跌,已经把答案写在盘面上了。
刘胜与在文章结尾写道:「那份坐在工位上静心写上一下午算子的清欢,可能会在这个夏天成为绝唱。」这句伤感的话里藏着一个清醒的判断——被埋葬的不是才华,是才华的一种兑现方式。才华本身,正在寻找下一个出口。
免责声明:本文基于公开报道与分析,仅供信息参考,不构成投资或决策建议。
