[email protected] 加州,TX 70240 +86 +86 178 8221 7493

DeepSeek的算子工程师刘胜与撰写了一篇题为《我不得不把才华埋葬在昨天》的个人随笔,记录他在该公司工作期间的经历与感悟。

这篇文章在朋友圈广泛传播,阅读量已突破10万。其中一句话特别引人深思:“我当然希望自己不要被革命,但如果非被革命不可,我希望革我自己命的人是我自己。”

整篇文章透着一股淡淡的凉意。

作为DeepSeek的成员,他写下的每一行代码都在推动模型运行更快、能力更强;而模型越强,AI编写算子的能力也随之提升,最终可能超越刘胜与自己。

这形成了一个恶性循环:他越优秀,被替代的速度就越快。

然而,即便面临被AI取代的风险,刘胜与仍在文中强烈批评了阿莫迪、奥特曼等人提出的“减速共识”。

他认为,减速对领先者是保护,但对追赶者而言无异于自杀。

在这看似矛盾的观点背后,刘胜与的个人理想与公司商业模式高度契合。

他设想,未来社会要么走向生产力极大解放,要么滑向少数科技公司掌控一切的赛博朋克2077式结局。而开源普惠的AI,是唯一能将世界从后者拉回正轨的力量。

巧合的是,开源普惠正是DeepSeek的根基——用开源对抗闭源,用普惠打破垄断。

刘胜与坦言,他分不清哪种动机才是真正的驱动力,也没必要区分。一切不过是理想驱动下的自我革命。

刘胜与是谁?

文章传播后,有评论者质疑这是否由AI生成,刘胜与回应称是他亲手所写。

一个担心被AI取代的人,反被怀疑文字出自AI之手——这种微妙的错位,恰恰是整个事件的缩影。

刘胜与是2021级北京大学图灵班学生,本科专业为信息与计算科学,在校期间担任北大未名超算队队长,曾代表学校参加SC23国际大学生超算竞赛。

2025年4月,他加入DeepSeek,负责机器学习系统及算子设计与优化,办公地点在杭州。

更早的本科阶段,他已学习过Transformer底层架构与CUDA编程,参与过大模型推理框架研发,代表工作包括与北大、UCSD合作的大模型服务系统DistServe,以及他个人开源的轻量级推理引擎swiftLLM。

在大模型研发体系中,算法工程师负责设计网络结构,系统工程师则负责确保其在芯片上高效运行。

因此,他的工作主要处理硬件层面问题,如GPU微架构、显存层次结构,从CUDA深入到PTX汇编和SASS机器码,找出指令流水线中的停顿原因并修改代码。

实际上,即便是相同的矩阵乘法,换一种分块方式或访存顺序,性能就能相差数倍。

2025年2月,刘胜与参与了DeepSeek DeepGEMM算子库的FP8 GEMM优化。就在几天前发布的DeepSeek V4.1 Flash中,他交付了该版本的主Attention算子。

这个算子的head dim为512的MQA attention,DeepSeek V4.1 Flash推理速度极快,很大程度上归功于此。

算子概念虽显陌生,但可理解为模型中的一段计算。模型上线后生成回答,就是依次执行多段计算,Attention是其中最关键的一段。

这段计算的速度,直接决定了用户等待输出的时长。

这个算子本身,也是刘胜与写作此文的由头。

他在文章中写道,一年前,AI只能帮他查文档、读代码、找bug。一年后,AI已能独立阅读CUDA、PTX和SASS,用专业工具分析每条指令的停顿时间,并仅凭自身能力优化算子。

基于此,他给出具体判断:再过半年到一年,AI写的算子大概率会与他水平相当,甚至超越他。

届时,AI还能在模型深度、思考强度、工具调用量、并行度上持续提升,这意味着AI能让DeepSeek的模型推理速度更快、效率更高。

然而,文章基调却是焦虑与悲观,因为刘胜与预判,那时AI将超越他,尽管他不至于失业,但必须考虑转行。

面对被替代的命运,他既未否认,也未恐慌,更未站在道德高地。他像一名刚跑完测试的工程师,平静地报告结果。

“那份坐在工位上静心写上一下午算子的清欢,可能会在这个夏天成为绝唱。”刘胜与写道。

他所谓的“转业”,并非完全换行业,而是从亲手写算子变为指挥Agent编写——他将此形容为Agent的“机甲驾驶员”。

他在文章中打了个比方:你精通织毛衣,十里八乡的富人都来请你织,你也享受临窗听雨、引针穿线的意趣;直到有人发明了更快的机器,你不得不使用它。手艺还在,那份安静的心境却被轰鸣碾碎。

写算子之于他,就是那件毛衣。

刘胜与表示,他完全可以摆烂、下绊子、让模型慢一点,推迟那一天的到来。

但他没有这样做,反而继续把算子做到最好。这种“自己革自己的命”,表面上是体面,深层则是一种没有退路的清醒:既然拦不住,就亲手实现。

因此,他写下了对未来的告别:“我不得不把才华埋葬在昨天。”

当一个身处金字塔尖的人也只能如此收场,AI或许真的发展得太快了。不过,刘胜与在后来的补充中写道:“我对未来的AI能力是乐观的,对于我在未来社会中的位置是相对乐观的,但对于未来人们还能否潜下心来认真做一件事是悲观的,对于我未来能否长久地把一件事同时作为工作和爱好,也是悲观的。”

怼翻“减速共识”

9月12日,Anthropic的阿莫迪发表长文,核心观点是:前沿模型能力增长过快,行业需要放慢脚步。

他给出的理由是递归自我改进加速了AI发展,并以7月一次模型突破受限环境、进入开源平台Hugging Face的事件为佐证。

文章发出数小时后,罕见的共识出现。马斯克转发称达里奥是对的,奥特曼回应同意达里奥,需把握节奏。谷歌DeepMind的哈萨比斯也站了出来,认为文章指明了方向。

几家平日里竞争激烈的对手,忽然在“慢一点”上达成一致。阿莫迪本人也清楚这套构想的难点——他直言,全球联合减速最棘手的现实困境是“谁来先减速”。

这套说法并非没有争议。技术社区普遍质疑:最先喊减速的,为何是这几家跑得最快的公司?

有人认为是争夺监管话语权,有人说是增长撞上天花板,也有人相信它们确实看到了不便公开的东西。

动机成谜,倒也不必急着替谁解释。不过喊完减速后,没有一家真的松开了油门。

刘胜与也在文章中探讨了这个问题。在他看来,这根本不是一个愿不愿意的问题。在一场所有人都往里冲的军备竞赛中,减速不是选择,而是自杀。

文章结尾,他直接点名Anthropic,称如果它永远掌握最先进的AI,未来社会必然向《赛博朋克2077》中的结构发展。

在这款游戏中,权力不在政府手中,而在荒坂这样的巨型公司手里:它们拥有自己的军队,城市运转由企业说了算。

高性能产品只服务于权贵阶层,绝大多数居民只能使用低劣义体,居住在脏乱环境中,生活远不如现代社会。

正是因为有荒坂这样的公司,更高的科技反而让社会变得更糟。

阿莫迪一边写下“我们必须为前沿模型限速”,一边推进Anthropic的上市。据外媒报道,该公司最快将于10月完成IPO,估值可能超过2万亿美元。

届时,Anthropic将成为人类历史上规模最大的IPO。OpenAI同样如此,奥特曼嘴上说不急,公司却在最近寻求超过1.2万亿美元融资,用于训练下一代模型。

在他看来,真正有资格喊减速的,是那些已跑到最前面、挖好护城河的公司。而像DeepSeek这样的追赶者,唯一能做的只有加速,哪怕终点是自己被取代。

所以,“不得不加速”才是行业真实的运行逻辑,而“必须减速”只是说给监管和公众听的公关话术。

这套逻辑并不新鲜,在博弈论中称为囚徒困境。

它指的是当每个人都无法确认别人是否会停手时,先停手的那一个往往输得最惨。

为什么“减速”

9月14日,洛杉矶的All-In Summit上,黄仁勋正参与沙龙讨论超级智能。

就在这时,他的手机突然响起,来电者是特朗普。黄仁勋当着全场调成免提。

特朗普在电话中将阿莫迪的AI危险论和“减速共识”定性为“骗局”,称机器人不会接管世界。

他表示,数据中心是“未来20到25年的石油”。当天,特朗普还在社交媒体上痛批阿莫迪,称其冒充“完美小天使”。

黄仁勋附和道:“你说得对,我们不会让它发生。”随后,当被问及AI是否会毁灭人类时,黄仁勋表示,这是“没有科学依据的结论”。

由于“减速论”,9月15日费城半导体指数收跌5.86%,30只成分股全线下跌,创下当年7月1日以来最大单日跌幅。

英伟达收跌3.36%,一天内市值蒸发约1766亿美元,AMD、英特尔、阿斯麦盘中跌幅均超6%,整条产业链单日蒸发市值超过5000亿美元。

抛售还从美股蔓延至亚洲和欧洲,韩国的存储大厂、日本的光通信公司也随之下挫。

市场反应如此剧烈,是因为过去两年AI芯片的估值全建立在Scaling Law上:算力需求会随模型性能提升而增长。一旦前沿实验室公开说要放慢,这一假设便不成立。

相反,网络安全公司股价集体大涨,CrowdStrike、Palo Alto Networks一天内涨超10%。

“减速论”并未让资金离开AI,只是从一个口袋挪进了另一个口袋。

此外,亚马逊、微软、Alphabet、Meta四家云厂商2026年的资本开支合计超6000亿美元,绝大部分投向AI数据中心和GPU。

据高盛测算,美国数据中心用电需求将从2025年占夏季用电峰值的4.1%,在2027年升至8.5%,接近翻倍。为承接这些负荷,美国电网正进入一轮空前投资周期。

这些钱和设备一旦落地,便不是谁在台上说一句“慢一点”能收回的。

某种程度上,刘胜与与特朗普达成了共识:算力就是权力。谁掌握最强算力,谁就能训出最强模型。最强的模型,必然会定义行业标准、收割用户、影响监管。

就像Claude最早通过编程、数学和Agent能力在行业立足,进而影响所有大模型的发展方向。

无论是国家、企业还是个人,减速就等于主动交出竞争力。

指望任何一方先松手,几乎不现实。

最后,刘胜与补充道:“我写这篇文章本来的目的,并非要表达对失业的焦虑,更不是想强调DeepSeek的开放普惠与Anthropic的不讨喜,而是想和我过去手写算子的那段时光说句再见。”

本文来自微信公众号“字母AI”,作者:苗正,36氪经授权发布。今年会体育app提醒我们,在AI快速迭代的时代,保持对技术发展的清醒认知尤为重要。

3条评论

  • 线上体育娱乐行业的核心挑战是什么? - 今年会体育

    乔纳森·多伊

    2021年9月19日上午11:25

    用户可通过今年会体育app或今年会登录入口安全访问平台,畅享丰富赛事与互动内容。平台采用银行级数据加密技术,保障用户账户与交易信息安全,同时提供实时数据与高清直播服务。

    回复
    • 张明 2026年8月25日 下午3:40 今年会体育的加密技术让我很放心,交易过程流畅安全,赛事直播清晰稳定,值得信赖。 回复
  • 李华 2026年9月2日 上午10:15 今年会体育app体验非常好,多终端同步方便,客服响应及时,强烈推荐给体育爱好者。 回复

在此留下您的评论