Karpathy 自己都认输了
2025 年 2 月,他发了条推文。
给这种编程方式起了个名字——Vibe Coding。
原话是「完全沉浸在氛围中,忘记代码」。
一年后,画风突变。
2026 年 4 月 AI Ascent 大会上,他说:
「从没觉得自己这么落后过。」
不是我危言耸听。
这套方法论,已经偷偷迭代了三代。
而大多数人,还停在第一代。
一、三阶进化:你卡在哪一层?
直接上结论,三张面孔一目了然:
| 阶段 | 核心理念 | 典型操作 | 致命问题 |
|---|---|---|---|
| 1.0 氛围编程 | 忘记代码,只管描述 | 「帮我写个登录页」 | 代码不可控,质量靠运气 |
| 2.0 Context Coding | 上下文工程决定产出质量 | 写 AGENTS.md、喂规则文件 | 需要前期投入,但 ROI 极高 |
| 3.0 Agentic Engineering | Agent 自主拆解+执行+验证 | 给目标,它自己规划编码测试 | 需要信任,但也要审查机制 |
1.0 氛围编程:祈祷式开发
你输入一句话,AI 吐出一坨代码。
你不懂,也不敢改。
能跑就谢天谢地,跑不了就再问一次。
本质上是在赌博。
赌运气好,赌 AI 今天状态在线。
像让实习生独自交付核心模块,你连 review 都跳过了。
2.0 Context Coding:给 AI 一本操作手册
你开始写规则文件。
告诉它项目用 React 不用 Vue。
告诉它提交前必须跑测试。
告诉它哪些目录不能动。
质量从玄学变成了工程。
同一个需求,有没有上下文,产出天差地别。
这一层的 ROI 最高,投入一小时能省十小时返工。
3.0 Agentic Engineering:当 AI 成了你的同事
你不再描述「怎么做」。
你只说「做什么」。
Agent 自己拆任务、写代码、跑测试、提 PR。
你只需要审查结果,而不是审查每一行。
这是质变,不是量变。
但别误会,信任不等于放任。
二、四款工具方法论适配度横评
先说清楚:这不是工具评测。
是看每款工具,把你推向哪个阶段。
| 维度 | Claude Code | Codex CLI | OpenCode | ZCode |
|---|---|---|---|---|
| 背景 | Anthropic 官方 | OpenAI 官方 | 开源社区(18万+ Star) | 智谱(GLM-5.2 原生) |
| 方法论适配 | 2.0→3.0 | 3.0 | 2.0 | 2.0→3.0 |
| 杀手锏 | 跨会话记忆、CLAUDE.md 上下文工程 | 沙箱隔离+自主执行 | 模型自由度最高 | 可视化操作、国产模型原生适配 |
| 适合谁 | 重度开发者 | 安全敏感场景 | 想自选模型、预算敏感 | 国内开发者、不想折腾 CLI |
Claude Code:上下文工程的教科书
它最懂「规则文件」这件事。
你写好 CLAUDE.md,它能记住项目约定。
跨会话不遗忘,连续性极强。
适配阶段 2.0→3.0,是渐进式升级的最佳载体。
适合愿意投入上下文工程的重度开发者。
Codex CLI:安全第一的执行机器
OpenAI 的安全基因刻在骨子里。
默认沙箱隔离,不碰敏感文件。
它会自主执行,但你始终能拉住缰绳。
适配阶段 3.0,但「不信任但验证」做得最彻底。
适合金融、安全敏感场景的用户。
OpenCode:模型自由度之王
18 万 Star 的开源社区在背后。
75+ 模型可选,想用哪个用哪个。
但自由度高也意味着——上下文你得自己搭。
适配阶段 2.0,灵活但需要自配规则。
适合预算敏感、想掌控模型选择的开发者。
ZCode:国产模型的原生适配者
智谱出品,GLM-5.2 模型原生集成。
可视化操作界面,不用对着黑框敲命令。
对国内开发者友好,理解中文需求更精准。
适配阶段 2.0→3.0,ADE 一体化做得好。
适合不想折腾 CLI、偏好可视化操作的人。
三、不绑定工具的四条心法
工具会换代,方法论不会。
这才是 2026 年真正该学的东西。
心法一:写好 AGENTS.md 比选对工具重要十倍
Context Engineering 是所有工具的底层逻辑。
不管你用 Claude Code 还是 Codex,底层都一样。
同一款工具,有上下文文件和没有,产出质量天差地别。
这就像同一个实习生,给他项目文档和不给他,结果完全不同。
你的规则文件,就是 AI 的入职手册。写得越细,产出越稳。
心法二:任务拆解粒度决定成败
小任务直接描述:修个 bug、加个按钮。
大任务先出方案:重构模块、新功能,确认后再执行。
一口气丢个大需求,结果一定让你崩溃。
Agent 会按自己的理解拆解,往往跟你想的完全不一样。
小步快跑,永远比一次梭哈靠谱。
心法三:审查 ≠ 不信任
Agent 产出必须验证,这不是不信任。
是 Code Review 的 Agent 化。
不看每一行代码,但要跑测试、查边界、review 关键逻辑。
信任是给空间的,验证是兜底的。两者不矛盾。
心法四:迭代循环,不是一次生成完事
| |
你不会让实习生一次交付完美代码。
Agent 也一样。
生成 → 验证 → 修正 → 再验证,才是正确姿势。
说在最后
工具会变,方法论不会。
Claude Code 明天可能就被别的工具超越。
但「上下文工程 + 任务拆解 + 验证迭代」这套心法,五年内不会过时。
2026 年真正该学的,不是哪个工具更强。
而是怎么跟 AI 高效协作。
这,才是你的护城河。
关注「varkm」,一起学习,一起成长。