众力资讯网

#DeepSeek工程师文章海外刷屏# 前几天 DeepSeek v4.1 发布了,DeepSeek 工程师写了一篇文章《我不得不把才华埋葬在昨天》,这篇文章在海外刷屏,直接爆火了,读完挺让人感慨的。 他就是这个模型里主 Attention 算子的作者,算子你可以理解成 AI 模型最底层、最核心的运算代码。这个东西写好了,模型跑 ​

DeepSeek工程师文章海外刷屏 前几天 DeepSeek v4.1 发布了,DeepSeek 工程师写了一篇文章《我不得不把才华埋葬在昨天》,这篇文章在海外刷屏,直接爆火了,读完挺让人感慨的。

他就是这个模型里主 Attention 算子的作者,算子你可以理解成 AI 模型最底层、最核心的运算代码。这个东西写好了,模型跑得更快,训练效率更高。他在这个领域是顶尖的。

但他说,AI 进步的速度实在太吓人了。从最早那个只会聊天的 ChatGPT,到能推理的 o1、R1,再到现在能自己操作工具完成复杂任务的智能体,前后也就两三年。在他自己干的算子领域,AI 一年前还只能帮他查查文档、找找 bug,现在已经能独立读懂底层代码、用专业工具分析性能瓶颈,然后自己把算子优化好。他估计再过半年到一年,AI 写算子的水平就能追上他,甚至超过他。

他对 DeepSeek v4.1 是骄傲的,毕竟核心算子是自己亲手写的。但他也很清楚,自己算子写得越好,模型进步就越快,AI 就越早能取代自己。那为什么还要拼命写呢?他说了两个原因。先说第一个,写算子对他来说就像打游戏,每次性能提升的那一刻,快感不亚于速通玩家破了纪录。然后第二个,就算他不干了,别家的模型也会照常进步,最后照样把他淘汰。他原话是,“如果非被革命不可,我希望革我自己命的人是我自己。”

他觉得自己不会失业,但必须转行。以前是亲手一行一行写算子,以后得转成 AI 的“机甲驾驶员”,靠经验指挥 AI 来干活。他打了个比方:你是个织毛衣的高手,花纹配色都是一绝,十里八乡的人都找你。你特别享受坐在窗边,泡壶茶,看着外头的山水,安安静静织一下午。后来有人发明了一台机器,放进毛线和图案就能自动织,质量不比你差,速度快得多。你凭经验还能比别人织得好,但那份安静手工的乐趣,没了。

他还聊到了几个让他担心的事。现在的学生会不会都用 AI 写作业?苦哈哈做八小时的 Lab,还不一定满分,AI 几分钟就搞定了,大部分人会选哪个?这样下去工程能力会严重退化。一个工程能力很差的人配上 AI,产出垃圾代码的效率是以前的好几倍,整个世界只会变得更草台。还有,未来社会里,权力会不会变得比技术和智商都重要?

最后他说,未来可能走向两个极端。一种是生产力大解放,大家都过上好日子。另一种是赛博朋克 2077,少数科技公司垄断最强的 AI,普通人只能用很弱的版本,阶层彻底固化。他不信 Anthropic 和 OpenAI 会把最好的 AI 开放给所有人,这也是他选择留在 DeepSeek 的原因:做强大、快速、便宜的 AI,然后开源,试着把世界从 2077 那个方向拉回来一点。