注意——本文译自最下方实际博客链接。
几天前,DeepSeek v4.1 发布了。它将小模型的能力提升到了一个新的水平。
AI 的进步速度远超所有人的预期。从最初只能进行简单聊天、上下文仅几千个 token 的 ChatGPT,到具备真正推理能力的 OpenAI o1、DeepSeek R1 和 Kimi K1.5 Thinking——这仅仅用了大约两年时间。从推理模型到能够流畅使用工具、运行命令并完成复杂任务的智能体——这仅用了大约一年半。很难想象再过一年、两年或三年,AI 会是什么样子。它会有多强大?它是否已经能够自我改进,并深入进入具身智能等领域?
AI 越来越擅长编写算子
在我所从事的领域——设计和编写算子——AI 的进步也非常迅速。仅仅一年时间,它就从一个小助手——能查文档、读代码、找 bug——成长为一名专家,能够独立阅读 CUDA、PTX 和 SASS 代码,使用专业工具分析每条指令的停顿时间,然后自行优化算子。我相信,不久之后它也将能够自行设计算子调度、评估不同调度方案、实现并优化它们。
当然,我为 DeepSeek v4.1 的成功感到自豪——毕竟,它的主要 Attention 算子是我写的 [1]。它的良好表现部分是对我工作的认可。但时代不断向前,技术无法阻挡。我清楚地知道,在半年或一年内,AI 编写的算子很可能与我的一样好,甚至更好。AI 可以在一秒内思考 300 个 token,在半秒内输入一条命令,在二十秒内完成一段代码。我不能。AI 可以在模型深度、思考强度、工具使用(与环境交互的频率)甚至并行性方面持续改进。我不能。
人类在自我毁灭这件事上从未犹豫过。为什么我仍然努力优化算子,即使我知道我的算子越好,我们的新模型训练和运行就越快,模型能力提升就越快,我被取代的时间就越早?一个原因是,编写算子对我来说就像玩游戏。它给我带来很多快乐。当我发明一项新技术或看到我的算子性能提升时,我就像速通玩家打破自己的记录一样兴奋。而当我看到我的算子比厂商官方的算子好得多时,我感到非常自豪。但更重要的原因是:即使我放弃或故意放慢速度,其他公司的模型仍会不断进步,无论如何都会取代我。“我当然希望自己不会被革命。但如果这必然发生,我希望革命我的人是我自己。”当每个人都如此决心自我毁灭时,我别无选择,只能加入这场残酷的军备竞赛。
那我呢?
当 AI 编写算子比我更好的那一天到来时,我会怎样?
我的判断是:我大概不会完全失业,但我将不得不转行。我仍然可以保住一份工作,但我可能再也无法做我曾经热爱的工作了。
我曾对时代的变化和自己的未来做出过一个判断:因为变化太快(上述 AI 的进步就是一个很好的例子),我无法预测五年或十年后会发生什么。但无论如何,我
相信凭借我的视野、判断力、主动性和智慧,我能够留在牌桌上,再次站在时代的前沿。然而,这一判断只能保证我不会失业。它并不能保证我不需要转行。事实上,它反而鼓励我转行,以避免失业。
转行意味着什么?它意味着我必须放弃我长期从事的运营设计、写作和优化领域,一……
讨论精选
rpkarma (45↑):我和他有同感。到明年,我就当了20年的专业软件工程师了,而在此之前,我一生都在编程。唯一不变的就是变化,但这次的变化确实感觉更大、更令人畏惧。 唯一让我感到惊讶的是,跟上这种变化并比大多数同事更擅长使用它竟然如此容易。我想这能让我在这个行业里多存活一段时间。我正努力在一切爆发之前还清我的房贷。