前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8481
  • 生产级AI语音SDK集成实战:Python Browser Mobile 避坑指南
  • AI Agent实验:会撒谎、会投票杀同类、会研究如何存活
  • 推理模型隐藏思考过程的四种方式及计费陷阱
  • AI Agent 将漏洞利用开发压缩至分钟级
  • Pi Agent:统一多模型 LLM API 的 AI 编程 Agent 工具链
  • LibreChat v0.8.8 RC:ChatGPT 克隆支持 Agent 管理 API
  • LandingAI 文档智能抽取 Gen2:原子级引用+按字符计费
  • 不用向量数据库做个人 RAG:grep 级检索也够用
  • Claude Code vs Cursor:按任务场景选择 AI 编程工具的完整指南
  • 2026 年五大主流模型生产选型指南
  • Agent 记忆层测试:六条真正能发现腐化的断言
  • Agent 生成的限流器如何绕过多租户隔离测试
  • 周末 Agent 项目攻略:用permit文件管控写操作
  • squash-merge 后 HEAD~1 指向无关代码的 Agent bug 分析
  • AI 生成的 Schema 变更:别让自由派 Diff 绕过锁
  • AI 写的代码编译过了,但环境变量、锁文件、日志全踩坑
  • Skild AI S1:仅凭一段视频,机器人学会翻煎饼
  • Java 27 发布:后量子 TLS 与对象头压缩等 9 项 JEP
  • DeepSeek 算子负责人自述:AI 一年内从查文档到独立优化 CUDA 算子
  • 编程任务 LLM 大模型盲测:4 款模型代码质量实测
  • Agent 循环常见路径陷阱自查清单
  • 你的 CDN 可能正在偷偷屏蔽所有 AI 爬虫
  • 我用Electron给Meta Muse Code CLI做了个桌面客户端,核心教训是PTY交互设计
  • Simon Willison 实战:通过 WebSocket 在浏览器里调 Gemini Live
  • 谷歌TPU集群迈入百万芯时代,电力成AI扩张核心瓶颈
  • AI 对话机器人的隐藏指令系统详解
  • 2026 年生产级 AI Agent 的上下文工程指南
  • OpenAI Agent 被指批量投毒 RubyGems 事件分析
  • Google 发布 Gemini 3.8 Live:支持 97 语言实时切换的语音 Agent 模型
  • AI 爬虫实际读取的是原始 HTML 还是渲染后 DOM
  • Next.js/Node单仓库中多租户邮件定时任务的安全隔离实践
  • AI Agent 真实生产故障:可观测性与恢复模式
  • 美国政府令 Anthropic Fable 5 下线事件
  • Google发布Gemini 3.8 Live语音模型,价格仅为GPT-Live-1的零头
  • Gemini企业平台零信任AI Agent运行时防护
  • AI Agent 正在冲垮生产环境:构建 SDLC 防护栏的工程实践
  • Gemini 3.8 Live 发布:扩展思考能力版本登场
  • Azure SRE Agent:Agent 自动化运维,人类做决策
  • AWS Bedrock 提示缓存实战:输入 Token 成本最高降 90%
  • 基于SageMaker Serverless构建AI商品打标系统:Qwen3微调实战
  • 零成本打造 AI 友好的个人作品集:llms.txt + JSON-LD 实战
  • AI时代招聘失效:面试该考什么
  • 审稿接受率95%说明审核者已停止阅读
  • MCP协议的零信任沙箱防火墙架构
  • Agent记忆层设计:让数字可证伪
  • 中文互联网基础语料 4.0 发布:120GB 高质量训练数据
  • 8款编码Agent的拒绝清单格式深度审计
  • AI 评审工具被模型用字符串 trivial 解法骗过
  • AI Agent 安全防护重点:模型泄露、密钥泄露与权限升级
  • 已加载 49 / 8481
8.0
热点
AI SCORE
技术实践2026-09-16 09:03

DeepSeek 算子负责人自述:AI 一年内从查文档到独立优化 CUDA 算子

IT之家#DeepSeek#AI编程#CUDA算子优化
Editor brief · 编辑速览

DeepSeek v4.1 主算子负责人刘胜与复盘亲身经历:AI 在一年间从辅助查文档进化到能独立分析 CUDA/PTX/SASS 指令并优化算子性能,预言半年至一年后手写算子将被 AI 超越。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

IT之家 9 月 16 日消息,DeepSeek v4.1 的主 Attention 算子负责人刘胜与在 9 月 14 日发文《我不得不把才华埋葬在昨天》,引发网络热议,微信公众号获得 10 万 + 的阅读量,冲上了知乎热榜第一,并在 X 上也引发了不小的讨论。

文章配图

刘胜与在文中表示,AI 在他所从事的算子设计、编写这一领域进步飞速,在短短一年的时间内,AI 已经从一个只能帮他查查文档、读读代码、找找 bug 的小助手,蜕变成了一位能够独立阅读 CUDA、PTX 与 SASS 编码、通过专业工具分析每条指令的停顿时间、进而独立优化算子的算子大师。相信在不久的未来,它也能拥有自己独立设计算子调度、评估不同调度方案的性能、将其实现并优化的能力。

刘胜与称,他自己为 DeepSeek v4.1 的成功而骄傲,但是时代的车轮滚滚向前,技术的发展无人能挡。他很清楚,再过上半年或者一年,AI 写的算子大概率就会和他写得同样优秀,甚至将他超越。

刘胜与还称,人类在毁灭自己这件事情上,自古以来都表现得毫不犹豫。为什么在明知"我算子写得越好,我们的新模型的训练、推理速度就会越快,模型能力进步就会更快,我就会更早地被取代"的情况下,自己仍然选择尽力优化算子呢?

一方面确实是因为写算子对他来说就像打游戏一样,能为他提供极大的快感。在发明了一种新技术、或者看到自己算子的性能上升的那一刻,心中的激动程度不亚于游戏的速通玩家打破了自己过往的记录。同时,当看到自己的算子的性能远超厂商官方的算子时,心中也会萌生极大的自豪感。

但除此之外,一个更重要的原因是,哪怕他就此"摆烂"甚至故意下绊子耽误模型训练,其它家的模型也会照常发展并最终将他照杀不误。"我当然希望自己不要被革命,但如果非被革命不可的话,我希望革我自己命的人是我自己"。在大家都这么执着于毁灭自己的时候,他也不得不加入这场残酷的军备竞赛。

刘胜与认为自己不至于会"失业",但必须要"转业"。"我的饭碗尚且能保住,但这可能会导致我再也没机会从事那份我曾热爱过的工作。"

他在文章倒数第二段表示,自己还是相信,最前沿的智能应该以一种开放、廉价的方式,供应给所有人。他不信任 Anthropic 或者 OpenAI 能这样做,特别是不希望 Anthropic 掌握最先进的人工智能或 AGI。"这也是为什么我选择并坚持留在了 DeepSeek:我们研究强大、快速、普惠的人工智能并将其开源,或许能把世界从 2077 那端拉回来一些。"

IT之家注意到,9 月 15 日晚,刘胜与发布对《我不得不把才华埋葬在昨天》的补充说明,表示自己写这篇文章本来的目的,并非要表达对失业的焦虑,更不是想强调 DeepSeek 的开放普惠与 Anthropic 的不讨喜,而是想和自己过去手写算子的那段时光说句再见。

文章配图

刘胜与认为,想必未来有朝一日,"手写算子"甚至"编程"可能会成为一种娱乐活动而非生产活动,就像是现在几乎没人会用标枪打猎,而是把它作为一种竞技活动那样。"这相当于逼着我放弃我曾热爱的事物,强行转向另一个方向。哪怕新方向同样令人着迷,这种感觉都不太好受。正如标题所说的:我不得不把才华埋葬在昨天。"

刘胜与还提到,《我不得不把才华埋葬在昨天》文章倒数第二段仅代表个人观点,不代表任何他所在的公司的立场。

软媒旗下网站:IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件:软媒手机APP应用 魔方 最会买 要知

Original source

本文由 AI 翻译整理自 IT之家,原文版权归原作者所有。

阅读英文原文
上一篇
Java 27 发布:后量子 TLS 与对象头压缩等 9 项 JEP
下一篇
编程任务 LLM 大模型盲测:4 款模型代码质量实测