Vibe Coding 三阶进化:从「帮我写代码」到「Agent 自己干」,你还在第几层?

Karpathy 一年前定义的 Vibe Coding 已经迭代了三代。工具换了又换,方法论才是真正的护城河。4 款主流 AI 编程工具横评 + 4 条实战心法。

Karpathy 自己都认输了

2025 年 2 月,他发了条推文。

给这种编程方式起了个名字——Vibe Coding。

原话是「完全沉浸在氛围中,忘记代码」。

一年后,画风突变。

2026 年 4 月 AI Ascent 大会上,他说:

「从没觉得自己这么落后过。」

不是我危言耸听。

这套方法论,已经偷偷迭代了三代。

而大多数人,还停在第一代。

一、三阶进化:你卡在哪一层?

直接上结论,三张面孔一目了然:

阶段核心理念典型操作致命问题
1.0 氛围编程忘记代码,只管描述「帮我写个登录页」代码不可控,质量靠运气
2.0 Context Coding上下文工程决定产出质量写 AGENTS.md、喂规则文件需要前期投入,但 ROI 极高
3.0 Agentic EngineeringAgent 自主拆解+执行+验证给目标,它自己规划编码测试需要信任,但也要审查机制

1.0 氛围编程:祈祷式开发

你输入一句话,AI 吐出一坨代码。

你不懂,也不敢改。

能跑就谢天谢地,跑不了就再问一次。

本质上是在赌博。

赌运气好,赌 AI 今天状态在线。

像让实习生独自交付核心模块,你连 review 都跳过了。

2.0 Context Coding:给 AI 一本操作手册

你开始写规则文件。

告诉它项目用 React 不用 Vue。

告诉它提交前必须跑测试。

告诉它哪些目录不能动。

质量从玄学变成了工程。

同一个需求,有没有上下文,产出天差地别。

这一层的 ROI 最高,投入一小时能省十小时返工。

3.0 Agentic Engineering:当 AI 成了你的同事

你不再描述「怎么做」。

你只说「做什么」。

Agent 自己拆任务、写代码、跑测试、提 PR。

你只需要审查结果,而不是审查每一行。

这是质变,不是量变。

但别误会,信任不等于放任。

二、四款工具方法论适配度横评

先说清楚:这不是工具评测。

是看每款工具,把你推向哪个阶段。

维度Claude CodeCodex CLIOpenCodeZCode
背景Anthropic 官方OpenAI 官方开源社区(18万+ Star)智谱(GLM-5.2 原生)
方法论适配2.0→3.03.02.02.0→3.0
杀手锏跨会话记忆、CLAUDE.md 上下文工程沙箱隔离+自主执行模型自由度最高可视化操作、国产模型原生适配
适合谁重度开发者安全敏感场景想自选模型、预算敏感国内开发者、不想折腾 CLI

Claude Code:上下文工程的教科书

它最懂「规则文件」这件事。

你写好 CLAUDE.md,它能记住项目约定。

跨会话不遗忘,连续性极强。

适配阶段 2.0→3.0,是渐进式升级的最佳载体。

适合愿意投入上下文工程的重度开发者。

Codex CLI:安全第一的执行机器

OpenAI 的安全基因刻在骨子里。

默认沙箱隔离,不碰敏感文件。

它会自主执行,但你始终能拉住缰绳。

适配阶段 3.0,但「不信任但验证」做得最彻底。

适合金融、安全敏感场景的用户。

OpenCode:模型自由度之王

18 万 Star 的开源社区在背后。

75+ 模型可选,想用哪个用哪个。

但自由度高也意味着——上下文你得自己搭。

适配阶段 2.0,灵活但需要自配规则。

适合预算敏感、想掌控模型选择的开发者。

ZCode:国产模型的原生适配者

智谱出品,GLM-5.2 模型原生集成。

可视化操作界面,不用对着黑框敲命令。

对国内开发者友好,理解中文需求更精准。

适配阶段 2.0→3.0,ADE 一体化做得好。

适合不想折腾 CLI、偏好可视化操作的人。

三、不绑定工具的四条心法

工具会换代,方法论不会。

这才是 2026 年真正该学的东西。

心法一:写好 AGENTS.md 比选对工具重要十倍

Context Engineering 是所有工具的底层逻辑。

不管你用 Claude Code 还是 Codex,底层都一样。

同一款工具,有上下文文件和没有,产出质量天差地别。

这就像同一个实习生,给他项目文档和不给他,结果完全不同。

你的规则文件,就是 AI 的入职手册。写得越细,产出越稳。

心法二:任务拆解粒度决定成败

小任务直接描述:修个 bug、加个按钮。

大任务先出方案:重构模块、新功能,确认后再执行。

一口气丢个大需求,结果一定让你崩溃。

Agent 会按自己的理解拆解,往往跟你想的完全不一样。

小步快跑,永远比一次梭哈靠谱。

心法三:审查 ≠ 不信任

Agent 产出必须验证,这不是不信任。

是 Code Review 的 Agent 化。

不看每一行代码,但要跑测试、查边界、review 关键逻辑。

信任是给空间的,验证是兜底的。两者不矛盾。

心法四:迭代循环,不是一次生成完事

 1
 2
 3
 4
 5
 6
 7
 8
 9
10
┌──────────────────────────────────────┐
│         Vibe Coding 迭代闭环          │
│                                      │
│   ┌──────┐    ┌──────┐    ┌──────┐   │
│   │ 生成 │───▶│ 验证 │───▶│ 修正 │   │
│   └──────┘    └──────┘    └──────┘   │
│       ▲                        │     │
│       └────────────────────────┘     │
│              再验证                   │
└──────────────────────────────────────┘

你不会让实习生一次交付完美代码。

Agent 也一样。

生成 → 验证 → 修正 → 再验证,才是正确姿势。

说在最后

工具会变,方法论不会。

Claude Code 明天可能就被别的工具超越。

但「上下文工程 + 任务拆解 + 验证迭代」这套心法,五年内不会过时。

2026 年真正该学的,不是哪个工具更强。

而是怎么跟 AI 高效协作。

这,才是你的护城河。


关注「varkm」,一起学习,一起成长。