23岁DeepSeek工程师刘胜与:AI正在学会写算子,我仍选择继续写

DeepSeek 工程师刘胜与在个人文章《我不得不把才华埋葬在昨天》中透露,DeepSeek v4.1 的主 Attention 算子由他编写,但他判断 AI 写算子的能力正快速逼近自己,于是选择主动成为“机甲驾驶员”,带 AI 做事。

一句话看懂:DeepSeek 工程师刘胜与在个人文章《我不得不把才华埋葬在昨天》中透露,DeepSeek v4.1 的主 Attention 算子由他编写,但他判断 AI 写算子的能力正快速逼近自己,于是选择主动成为“机甲驾驶员”,带 AI 做事。

事件核心:发生了什么

2026 年 10 月,一篇来自公众号“贾克斯的平行世界”的转载文章引发关注。文章主角是 23 岁的 DeepSeek 工程师刘胜与,北大图灵班毕业,曾任北大未名超算队队长,毕业时同时拿到伯克利和卡内基梅隆的博士 Offer,但他都拒绝了。2025 年他进入 DeepSeek 实习并最终留任。

他在文章中表示,DeepSeek v4.1 的主 Attention 算子由自己编写,这是他骄傲的事。但让他不安的是,一年前 AI 还只能查文档、读代码、找 bug,如今已经能自己阅读 CUDA、PTX、SASS 编码,用专业工具分析指令停顿时间,再独立优化算子。他判断,再过半年到一年,AI 写出的算子很可能和他一样好,甚至超过他。

为什么重要

这个案例不是实验室里的抽象讨论,而是来自一线大模型公司的真实体感。算子是模型训练和推理性能的关键底层组件,直接关系到算力利用效率和成本。如果 AI 能独立阅读并优化 CUDA 代码,意味着大模型公司最核心的工程师工作之一,正在从“人写代码”转向“人带 AI 做事”。

对 DeepSeek 这类同时做模型和底层优化的团队来说,这既是效率提升,也是组织能力的重构。刘胜与说,就算他停下来,其他公司也不会停。他的选择是主动参与替代自己的过程——“如果非被革命不可,我希望革我自己命的人是我自己。”

对用户/开发者/创作者的影响

对开发者而言,底层代码能力仍然是基础,但“自己一行行敲完一个下午”的节奏会越来越少。更常见的模式是:调用 Agent 处理重复优化,人负责判断方向、设计架构、理解硬件和模型之间的取舍。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对 AI 应用和内容创作者来说,这个趋势同样存在:AI 接管执行层,人保留品味、判断和问题定义能力。刘胜与用“织毛衣”作比——机器能织得又快又好,但窗边那个慢慢织的下午没有了。工作还在,工作方式变了。

值得关注的后续

一是“AI 写算子”的能力边界。目前公开信息显示,这仍是刘胜与个人基于工作经验的判断,尚未有 DeepSeek 官方产品公告或可核查的评测数据。二是 DeepSeek v4.1 的后续版本是否会更系统地把 Agent 引入底层算子优化流程。三是其他大模型公司是否公开类似实践,即由 AI 辅助或独立完成 CUDA 算子优化。

来源:社区更新 · 2026-10-10

celebrityanime
celebrityanime
文章: 28750

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注