mt logoMyToken
ETH Gas
EN

DeepSeek核心工程师长文刷屏:我不得不把才华埋葬在昨天

Favoritecollect
Shareshare

原文作者:龙玥

原文来源: 华尔街见闻

9 月 14 日,刚刚交付 DeepSeek V4.1 核心算子的青年工程师刘胜与,以一篇记录技术变迁与个人心路的长文《我不得不把才华埋葬在昨天》在海内外技术社区持续刷屏,引发关于 AI 时代开发者命运与技术演进的广泛讨论。

词条#我不得不把才华埋葬在昨天#也冲上知乎热榜第一。

作为大模型底层的核心构建者之一,DeepSeek 机器学习系统工程师刘胜与的技术履历十分突出。他是北京大学 2021 级计算机“图灵班”成员,曾担任北大未名超算队队长并代表学校出征国际大学生超算竞赛 SC23。2025 年 4 月加入 DeepSeek 后,他承担了关键的底层算子研发工作,并在几天前刚刚完成了 DeepSeek V4.1 主 Attention 算子(head dim = 512 的 MQA attention)的代码交付。

刘胜与在文章中坦言,虽然自己为 DeepSeek V4.1 核心算子的成功感到自豪,但也十分清楚技术的不可逆演进。

“再过上半年或者一年,AI 写的算子大概率就会和我写得同样优秀,甚至将我超越,” 刘胜与直言,“AI 能一秒思考 300 个 token、半秒敲出一行命令、二十秒写完一份代码,而我不行;AI 能在模型深度、思考强度、工具调用量甚至并行度等方面不断提升,而我不能。”

这种极速进化将开发者推入了一种深刻的技术悖论之中:他把算子优化得越好,新模型的推理与训练就越快;模型能力进步越快,AI 取代人工写算子的时间节点就来得越早。

面对这种不可抗拒的趋势,刘胜与写道: “人类在毁灭自己这件事情上,自古以来都表现得毫不犹豫……我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己。”

“我不至于失业,但必须要转业”

针对外界关于程序员饭碗的担忧,刘胜与给出了清醒的判断:工程师群体不至于面临真正意义上的“失业”,但必然需要经历深刻的“转业”。

“转业代表着我需要放弃我深耕已久并充满热爱的算子设计、编写、优化领域,转而去做 Agent 的‘机甲驾驶员’,”他写道,“在之前,我的兴趣、我所擅长的以及工业界所需要的,三者是基本对齐的;而现在,工业界的需求从‘会写高性能算子的人’漂移到了‘能用 AI 更快地产出高性能算子的人’。”

他将这种手艺的失落比作自动化织袜机出现对老手艺人的冲击。即使凭借过往经验依然能把机器用得最好,但曾经“临窗听雨、引针穿线、慢度光阴的意趣,终究还是被机器的轰鸣碾碎了”。

“我的手中多了些齿轮,但心中少了些节拍,”他感慨道。

除了个人职业转变,刘胜与还在文中表达了对年轻一代工程能力退化的担忧。如果学生普遍依赖 AI 在数分钟内完成复杂的代码作业,系统架构与抽象设计能力或将出现断层,“一个工程能力很差的人,在搭配上 AI 后,产出屎山的效率可以达到先前的数倍,进而给系统埋下各式祸患,让这个世界变得更加草台。”

澄清初衷:与“手工业时代”的体面告别

由于文章发布后在各大平台引发了有关地缘政治、机构竞争乃至失业焦虑的过度解读, 刘胜与随后发布补充说明,澄清了自己的写作初衷。

他表示,文章并非表达对饭碗的焦虑,也不是为了挑起 DeepSeek 与 Anthropic 等闭源机构的对抗,其核心动机只是向过去“纯手写算子”的纯粹时光做一次认真的告别。

“想必未来有朝一日,‘手写算子’甚至‘编程’可能会成为一种娱乐活动而非生产活动,就像是现在几乎没人会用标枪打猎,而是把它作为一种竞技活动那样,”刘胜与写道,“这相当于逼着我放弃我曾热爱的事物,强行转向另一个方向。哪怕新方向同样令人着迷,这种感觉都不太好受。正如标题所说的:我不得不把才华埋葬在昨天。”

谈及为何坚持留在 DeepSeek,刘胜与重申了自己的信念:最前沿的智能应当以开放、普惠的方式供应给全社会,避免核心能力被极少数商业寡头彻底垄断。

“在不得不把才华埋葬在昨天后,我还有明天的光明可以追逐,”他在补充说明结尾表示,自己将继续投身于引入 AI Agent 编写算子的新流程中,在拥抱新技术工具的同时,寻找属于新时代的落脚点。

原文如下:

《我不得不把才华埋葬在昨天》
原创 intlsy 的狗窝 2026 年 9 月 14 日 00:26 浙江
前几天,DeepSeek v4.1 发布了,将小模型能力的高度又向上推进了一个档次。
AI 发展的速度远远超过了所有人的预期。从那个只会咿呀学语地聊天、上下文长度只有几千 token 的初版 ChatGPT,到具有推理能力的 OpenAI o1、DeepSeek R1 与 Kimi K1.5 Thinking,只不过短短两年;从推理模型到如今能够流畅地在各类 harness 工具中执行命令、完成复杂任务的智能体,也不过一年半。很难想象,倘若再等上一年、两年、三年,彼时的 AI 会成为什么样子,会有多么强大,会不会已经具备了自我进化的能力,并深度渗透进了具身智能等领域。

AI 越来越会写算子了

AI 在我所从事的算子设计、编写这一领域同样进步飞速,在短短一年的时间内,他已经从一个只能帮我查查文档、读读代码、找找 bug 的小助手,蜕变成了一位能够独立阅读 CUDA、PTX 与 SASS 编码、通过专业工具分析每条指令的停顿时间、进而独立优化算子的算子大师。相信在不久的未来,它也能拥有自己独立设计算子调度、评估不同调度方案的性能、将其实现并优化的能力。
我当然为 DeepSeek v4.1 的成功而骄傲 —— 毕竟它的主 Attention 算子都是我写的 [1],它的优秀正是对我的算子的一份肯定。但是,时代的车轮滚滚向前,技术的发展无人能挡。我很清楚,再过上半年或者一年,AI 写的算子大概率就会和我写得同样优秀,甚至将我超越。AI 能一秒思考 300 个 token、半秒敲出一行命令、二十秒写完一份代码,而我不行;AI 能在模型深度、思考强度、工具调用量(和环境交互的频率)、甚至并行度等方面都能不断提升,而我不能。
人类在毁灭自己这件事情上,自古以来都表现得毫不犹豫。为什么在明知“我算子写得越好,我们的新模型的训练、推理速度就会越快,模型能力进步就会更快,我就会更早地被取代”的情况下,我仍然选择尽力优化算子呢?一方面确实是因为写算子对我来说就像打游戏一样,能为我提供极大的快感。我在发明了一种新技术、或者看到自己算子的性能上升的那一刻,心中的激动程度不亚于游戏的速通玩家打破了自己过往的记录。同时,当看到自己的算子的性能远超厂商官方的算子时,我心中也会萌生极大的自豪感。但除此之外,一个更重要的原因是,哪怕我就此“摆烂”甚至故意下绊子耽误模型训练,其它家的模型也会照常发展并最终将我照杀不误。“我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己”。在大家都这么执着于毁灭自己的时候,我也不得不加入这场残酷的军备竞赛。

那我呢

等到 AI 写算子的水平真的高于我的那天,届时的我会怎么样呢?
我的判断是:我不至于会“失业”,但必须要“转业”。我的饭碗尚且能保住,但这可能会导致我再也没机会从事那份我曾热爱过的工作。
我曾经对时代的变化与我个人在未来的处境做出过一个判断:由于时代变化真的太快(上文的 AI 发展就是一个很好的例子),我完全无法预知五年、十年后会发生什么,但不论如何,我相信凭借着自己的眼界、判断力、主观能动性与智力,留在时代的牌桌上,并重新立于时代的潮头。但是,这个判断只能保证我不会“失业”,而无法保证我不需要“转业”,倒不如说这个判断鼓励我通过转业来避免失业。
那转业代表什么呢?它代表着我需要放弃我深耕已久并充满热爱的算子设计、编写、优化领域,转而去做 Agent 的“机甲驾驶员”。在之前,我的兴趣、我所擅长的、以及工业界所需要的,三者是基本对齐的;而现在,AI 让我所擅长的变成了它更擅长的,也让工业界的需求从“会写高性能算子的人”漂移到了“能用 AI 更快地产出高性能算子的人”。为了适应工业界的需求,我势必要放弃之前那个我热爱的方向,转向一个未知的新方向。我相信我能凭借着自己对于工程学、上层模型需求和底层硬件的理解,继续高质量、高效率地产出算子,我也知道我可能会热爱这个新方向(也可能不会),但被夺走热爱的感觉,确实不太好受。那份坐在工位上静心写上一下午算子的清欢,可能会在这个夏天成为绝唱。我不得不把才华埋葬在昨天,去做一位机甲驾驶员。我的手中多了些齿轮,但心中少了些节拍。
可以打个形象的比方:你精通织毛衣技术,尤其擅长各种图案的织造与各色色彩的搭配。你所织出的毛衣质量过硬且花纹美观,十里八乡的富人都来请你为他们织毛衣,你借此赚到了不少钱。同时,你十分享受着那种坐在窗边,沏一壶清茶,望着窗外的青山、绿水、牛羊与炊烟,静静地织上一下午毛衣的感觉。但有一天,有人发明出了一台神奇的机器,只需提供毛线与图案,便可自动织出毛衣,质量与纹理都不亚于你亲手织造的,且速度远快于你。你很清楚,你的同行可以凭着这台机器轻松达到你曾经的水平,因此你不得不也去用它。你也知道,凭借着你过去二十年攒下的织毛衣技术,哪怕大家都有机器,你织毛衣的速度与质量也还能超过同行。但那份临窗听雨、引针穿线、慢度光阴的意趣,终究还是被机器的轰鸣碾碎了。
我知道这很无奈,但没办法。饭碗可以保住,但旧日的热爱大概率是要放弃的。我是一个理性和感性分离得比较开的人,在需要用理性处理问题时可以很理性,但有时也会表现出感性的一面。我记得我在搬离住了一年的出租屋时,还大哭了一场,舍不得和过去的记忆分别。今天和之前那个手写算子、人脑优化的时代告别,无疑比这更加残酷。
不知道有没有读者有类似的感受,但我想这事儿也只能这样了。

那人们呢

在 AI 不断进步的同时,我也对一些问题表示担忧:
  • 现在的学生是不是大概率会更倾向于使用 AI 完成作业,特别是偏向于实践的各种 Lab?想象一下,如果面前有两个选择,一个是苦哈哈地用八小时时间完成一个 Lab,或许还拿不到满分;另一个则是启动 AI 模型,用几毛钱的成本、几分钟的时间,直接让 AI 编写满分代码,那大部分学生会选择哪个呢?
  • 上面一点会导致大量学生的工程能力严重不足,包括组织代码的能力、构建系统的能力、思考未来潜在需求并提前在设计上应对的能力、抽象的能力等等。那么在 AI 能力不断变强的背景下,这部分“工程能力”是否还是必须的呢?这些工程能力是会向旧日的“熟练编写 x86 汇编”的能力那样逐渐被时代抛弃,还是会像“理解从软件到系统再到硬件的整套计算机系统”的能力那样永远具有价值?如果是后者的话,那就危险了 —— 一个工程能力很差的人,在搭配上 AI 后,产出屎山的效率可以达到先前的数倍,进而给系统埋下各式祸患,让这个世界变得更加草台。
  • 在未来社会中,权力(power)是不是会比技术或智商更加重要?
这些问题,或许就需要时代本身来回答了。

结语

伴随着 AI 的发展,未来的社会可能会趋向于两个极端:共产主义与赛博朋克 2077。在前者中,生产力得到极大的解放,人们的生活水平有了明显的提高;而在后者中,少数科技公司控制着大部分资源,只有极少数人能够使用最先进的 AI 和各式科技,获得接近“机械飞升”的效果,大部分人则只能用上很孱弱的 AI。阶层跨越将越来越难实现:你得先有最强的 AI,才能跨越阶层,形成了一种死循环。
你猜猜如果 An****pic 公司永远掌握着这个世界上最先进的 AI,未来社会是会变成共产主义还是 2077 呢?你猜?
所以,我还是相信,最前沿的智能应该以一种开放、廉价的方式,供应给所有人。我不信任 Anthropic 或者 OpenAI 能这样做,特别是不希望 Anthropic 掌握最先进的人工智能或 AGI,夸张点说其严重性不亚于让希*勒先于盟军掌握原*弹技术。这也是为什么我选择并坚持留在了 DeepSeek:我们研究强大、快速、普惠的人工智能并将其开源,或许能把世界从 2077 那端拉回来一些。
愿未来的世界一切安好。May all the beauty be blessed.
[1] “主 Attention”仅包括 head dim = 512 的 MQA attention,不包括用于选出 top-k 重要的 token 的 indexer,那部分是由其他(水平也非常强的)同事(以及他们的 AI Agent)编写的。
对《我不得不把才华埋葬在昨天》的补充说明
原创 intlsy 的狗窝 2026 年 9 月 15 日 19:50 浙江
这次这篇文章火出圈了,微信公众号这边获得了十几万的阅读量,冲上了知乎热榜第一,并在 X 上也引发了不小的讨论。
这波爆火其实是挺出乎我意料的,只可惜,大家的关注点和我想表达的并非完全对齐。
我写这篇文章本来的目的,并非要表达对失业的焦虑,更不是想强调 DeepSeek 的开放普惠与 Anthropic 的不讨喜,而是想和我过去手写算子的那段时光说句再见。 在 Agent 出现之前,大部分代码都是我一个字一个字敲出来的,这看似枯燥的过程,对我来说反而是一种享受:我可以静下心来,仔细思考大到模块组织、功能排布,小到代码逻辑、变量命名的每个细节。我也享受绞尽脑汁研究算子的调度和优化方案,提高算子性能,最终打败公认实现(比如 Flash Attention,NVIDIA 官方编写的算子,甚至是某些之前公认的“不可能优化好”的任务,比如 token 级稀疏的 attention)的感觉 —— “我在发明了一种新技术、或者看到自己算子的性能上升的那一刻,心中的激动程度不亚于游戏的速通玩家打破了自己过往的记录”。但是,现在这种快乐要被 AI 夺走了:为了生产效率和算子性能(现在的 AI 干活儿比我快,以后的 AI 则是又快又好),我必须迎接新时代中的新事物,研究如何用 AI 更好地写算子,在工作时间中再也没机会享受静静地、慢慢地写算子、调算子、优化算子的时光了。想必未来有朝一日,“手写算子”甚至“编程”可能会成为一种娱乐活动而非生产活动,就像是现在几乎没人会用标枪打猎,而是把它作为一种竞技活动那样。这相当于逼着我放弃我曾热爱的事物,强行转向另一个方向。哪怕新方向同样令人着迷,这种感觉都不太好受。正如标题所说的:我不得不把才华埋葬在昨天。
我是一个很看重记忆和感动的价值的人,可奈何记忆会褪色,会被时光的细雪渐渐掩埋。之前还写过另一篇文章聊了聊这事儿: 2025 年终总结之二:记忆 。因此,这篇文章其实是对我过去时光的一段总结与怀念。我希望借这篇文章,将过往的那些手写算子影像定格,以保存这份真切的记忆与真挚的感动,供十年、二十年之后的我来怀念。顺带借着这篇文章,给予自己放下过去、拿起新工具、勇敢地走向新时代的勇气。
↑ 一段我很喜欢的话,节选自公众号评论区
但大家的理解似乎和我的原意出现了不小的偏差... 本来文章的最后两节只是一些碎碎念:倒数第二节简要提及了一些 AI 带来的社会问题,但其实也没有很仔细地去分析或回答;最后一节则是我个人在前段时间的一些零碎思考,认为前沿智能还是应该“以一种开放、廉价的方式,供应给所有人”。但由于我并不是历史学、社会学等人文学科的专家,这部分我也只是稍加探讨并一带而过(顺便踩一脚我一直看不太惯的 A/),里面关于共产主义与 2077 的辩论也不一定对。虽然里面说的“我选择 DeepSeek 的原因之一是不想让世界变成 2077 那副模样”以及“May all the beauty be blessed”两句话是真的,这确实是我的理想,但这并不是本文的中心。这一段也仅代表个人观点,不代表任何我所在的公司的立场。或许等我未来有朝一日把这个问题想清楚一些后,会再开一篇文章来写一写。
结果,这篇文章发出去之后,虽然确实有很多人和我关于旧日时光的怀念产生了共鸣,但大部分人都把聚光灯打在了最后一段上。知乎上排名最高的几条回答写得还行(说明知乎用户的阅读理解能力还是挺好的),但微信公众号评论区中有大量人在探讨 Anthropic 和 DeepSeek 关于开放智能的态度,小红书上甚至已经有“DeepSeek 反击 Anthropic”这种回答了......我很感慨某些学新闻学的的炒作能力,同时看了这些之后感觉很无奈... 大家还是多关注关注文章的主题吧。
回归主题,AI 在未来不断变强是肯定的:哪怕局限于当下的 Agent + Harness + 长上下文 + CoT 的范式,随着数据质量、模型深度、上下文长度不断继续扩展(scale),AI 的能力也将稳步前进。更别提,后面还等着具身智能、RSI、以及一些我们尚未知晓的其他技术。我对未来的 AI 的能力是乐观的,对于我在未来社会中的位置是相对乐观的,但对于未来人们还能不能潜下心来认真做一件事情是悲观的,对于我未来能不能长久地把一件事情同时作为工作和爱好,也是悲观的。
但哪怕这样,我还是要继续坚持写算子、以及不断引入 AI Agent 写算子。一是因为“我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己”(被别人淘汰不如自我进化);二是因为我还是希望我们(或者其他同样秉持着开放共享理念的 AI 公司)能够先于某些公司,做出最强大的智能,惠及所有人。我还是相信我原文中关于共产主义和 2077 的论调,也希望这个世界能尽量离 2077 那端远一些。爱好兴趣是一回事儿,理想信念则是另一回事儿了,因此我也将继续在这个领域开拓下去。我在未来也会尽量尝试重新对齐爱好、特长和时代需求的方向,尝试在属于 AI 的时代找到属于自己的乐土。在不得不把才华埋葬在昨天后,我还有明天的光明可以追逐。在被这场世末的凉雨淋湿后,我仍会用回温的心灵驱散阴霾,寻找越过黑夜后渐变的那一抹蓝色 [1]。
[1] 化用了 COP 的《世末歌者》等歌曲的歌词。
Disclaimer: This article is copyrighted by the original author and does not represent MyToken’s views and positions. If you have any questions regarding content or copyright, please contact us.(www.mytokencap.com)contact
More exciting content is available on
X(https://x.com/MyTokencap)
or join the community to learn more:MyToken-English Telegram Group
https://t.me/mytokenGroup