Karpathy公开反思vibe coding的局限性,主张用更严谨的agentic engineering方法替代,即有目标导向、迭代反馈的AI辅助编程模式。
Andrej Karpathy 是 AI 领域的关键人物,他公开阐述了自己在 AI 辅助软件开发方法上的重大转变。这一转变摒弃了他所称的"vibe coding"(氛围编程),转向"agentic engineering"(智能体工程),代表了专业人士与 AI 工具交互方式的一个关键拐点。本文深入探讨了 Karpathy 18 个月以来的思想演进,详细记录了从随意 AI 提示到更加严谨、规范化方法论的转变。andrej karpathy retires vibe coding agentic 的出现,标志着人们对 AI 在复杂软件创作中角色的理解正走向成熟。
2025 年 2 月,Andrej Karpathy 在 X 上首次提出了"vibe coding"概念。这一术语描述了一种新兴实践:对 AI 生成的代码保持最低程度的审视,通过将错误信息反馈给 AI 模型进行迭代,优先考虑快速原型而非深入探究底层实现。Karpathy 本人就是这一趋势的典型代表,他在 2025 年 12 月指出,自己 80% 的代码已由 AI 生成。这种快速采用和业界对"vibe coding"的广泛认可,突显了它在降低 AI 辅助开发准入门槛上的直接影响力,甚至让没有传统编程背景的人也能上手。
这不是 Karpathy 第一次创造能够捕捉重大技术转变的短语。他在 2017 年提出的"Software 2.0"概念(发表于 Medium)认为,神经网络是一种新的编程底层,开发者定义的是期望结果而非显式指令。2023 年 9 月,他进一步扩展了这一框架,将大语言模型描述为不仅仅是对话机器人,而是新型操作系统的核心进程,上下文窗口充当 RAM,智能体充当长期运行的进程。这些概念标签每一个都在业界广泛命名之前就已经提出,有效地压缩了下一波创新到来的时间线。
StartupHub.ai 的数据反映了这一动态变化,显示 AI 开发者工具公司数量显著增长——这个类别在 Karpathy 首次讨论"Software 2.0"时还处于萌芽期。当前的格局(许多公司仍处于 Seed 阶段)与 Karpathy 对 vibe coding 阶段无结构性质的观察一致,需求超过了正式的工具和规范。
2025 年 12 月宣布自己 80% 的代码由 AI 生成,这标志着 Karpathy 的一个质的转折点。这个数字不是预测,而是对他实际工作流程的描述。他将这一时期定义为"智能体编程的拐点",此时 AI 生成的代码块已经变得足够大且连贯,主要挑战从 AI 处理任务的能力转变为人类大规模验证其输出的能力。在这个节点上,Karpathy 指出他已经不记得上一次在任务中途手动纠正 AI 方向是什么时候了。
这一区分对于区分"vibe coding"和"agentic engineering"至关重要。Vibe coding 广泛接受 AI 输出,便于快速原型和更广泛的 접근性。相反,agentic engineering 的基本前提是 AI 智能体是"会犯错且具有随机性的",正如 Karpathy 在 2026 年 4 月红杉资本 AI Ascent 活动上所述。这要求在开发的每个阶段都进行专业监督。虽然工具看起来相似,但underlying的纪律要求却截然不同。到 2026 年 2 月,业界出版物已经开始将这一转变描述为 Karpathy 最初定义的随意阶段的自然继承者。
在红杉 2026 AI Ascent 大会上,Karpathy 提供了他对 agentic engineering 最全面的定义。在随后的一篇博客总结中,他将 agentic engineering 描述为"在保持正确性、安全性、品控和可维护性的同时,协调有缺陷的智能体的专业学科"。他尖锐地将此与 vibe coding 对比:"Vibe coding 提高了下限。Agentic engineering 是为了 extrapolation 上限。"他进一步指出,对于精通这一新学科的人来说,生产力的基准可能远远超过通常所说的"10x 工程师",峰值可能更高。
Karpathy 概述了定义这一职业道路的四个关键实践:
详细规格说明:在与 AI 智能体交互之前编写全面的规格说明。
批判性审查:严格审查智能体生成的代码变更(diffs),检查正确性和安全漏洞。
自动化评估:设计强大的评估循环以检测回归并确保持续质量。
权限管理:在整个代码库中有效管理 AI 智能体权限。
他强调"Eval design"(评估设计)是即使在向 agentic 工作流程过渡的有经验工程师中最常见的能力短板。这种对结构化评估和监督的关注是 andrej karpathy case agentic engineering 2026 叙事的关键,强调了向更可预测和可靠 AI 集成的迈进。
在红杉演讲六周后,2026 年 5 月 19 日,Karpathy 宣布了他在 Anthropic 领导预训练研究的新角色,在 Nick Joseph 手下工作。他的公告引起了广泛关注,获得了 148,000 个赞和超过 7,800 条回复。他对前沿模型训练阶段——这一塑造其核心推理和知识的过程——的关注,是他关于 agentic engineering 论点的结构性延伸。AI 智能体能达到的上限从根本上取决于预训练的质量,而他现在正深度参与这一领域。
Karpathy 从"忘记代码的存在"到"协调有缺陷的智能体的专业学科"的 18 个月历程,反映了行业当前的演进阶段。易于 접근 的"下限"已经通过随意的 AI 辅助得到提升,而专业的"上限"现在正由深入理解当前 AI 智能体能力和局限性的实践者来定义。他在 Anthropic 的新角色——塑造未来的训练,这将决定未来智能体能处理什么——使他能够影响这个上限的定义。agentic engineering 是否会巩固为正式的职位头衔,还是仅仅成为 2028 年软件工程的新标准,还有待观察,但 Karpathy 目前的工作对于回答这个问题至关重要。
有关 AI 演变及其对开发影响的更多见解,可以探索详细分析,例如 PDF 格式的资料,包括 AI 开发者工具的综合概述和 AI 对创业生态系统影响的深入探讨。
tags: ai, andrej karpathy, agentic engineering, vibe coding, software development, artificial intelligence, machine learning