将Vibe Coding从耗神低效转为高效可靠

简介: 本文提出“AI自助闭环”工作流:通过构建CLI模拟测试平台+TDD+预设问题清单重构,在无需人工干预下实现AI自主编写、测试、修复与优化代码。核心是让AI获得即时反馈能力,将Vibe Coding从耗神低效转为高效可靠。

前段时间 Vibe Coding 每天都搞到凌晨三四点,实在是有点红温,大部分都是浪费时间,每次我一 Vibe Coding 就被束缚在桌前了。问题在于既然是 AI 那本应是来解放人类的,不应该是让人类更疲惫的。

于是结合经验,我对我的整个工作流程稍微反思了一下,并得到一些惊喜的结果。

我发现,只要对工作流稍作改造 —— 引入反馈闭环 —— 就能显著提升体验与质量,其中的核心在于建立一套 AI 能够 “自助验证” 的机制。不需要多复杂的技巧去定制 Claude Code,全部对 Claude Code 的修改只有稍微修改了一下 CLAUDE.md

下文将介绍一套极其简单且有效的实践路径。虽然具体流程需结合项目定制,但其投入产出比非常可观。希望能给大家一点启发。


为什么大部分人 Vibe Coding 体验很差?

举个典型场景。

比如你要开发一个聊天机器人插件:

写完代码 → 手动部署 → 手动测试 → 发现 Bug → 把日志喂给 AI → 修复 → 再部署……

一个 Bug 可能来回改好几轮。等功能 “看起来能跑了”,代码往往已经支离破碎。若想重构,又担心引入新 Bug。整个过程高度依赖人工介入,既费时又不可控。

当我们把需求、文档和示例都给到 AI 时,它理论上具备了开发的前置条件。为什么还需要人去不断介入?

因为缺少反馈闭环。 AI 就像在那盲射,无法直接拿到反馈。每次直接写出来的东西,大概率是不能直接跑的。


解决方案:构建自动化闭环 (反馈循环)

一:回归 TDD (测试驱动开发)

既然 AI 写代码容易出 Bug,那就立好规矩,让它严格遵循 TDD:

  1. Red:先写测试 (此时运行失败)
  2. Green:写代码让测试通过
  3. Refactor:在测试保护下重构

AI 应当负责编写测试、运行测试、根据报错自行修复的全过程。


二:构建端到端测试平台 (关键)

单元测试能保逻辑,但保不了业务场景。这一步是整个方法的核心,也是最需要开发者投入的地方。

关键洞察

以 AstrBot (一个机器人框架) 开发为例,传统的 “上号测试” 效率极低。

但如果我们换个思路:AstrBot 本质是 “输入消息 → 处理 → 输出响应”。

既然 AI 无法操作 QQ 客户端,我们能否为它做一个基于命令行的模拟器?

基于这个想法,我开发了一个 AstrBot CLI 测试平台
image-20260407172335372

image-20260407172346383

它能让 Claude Code 直接在命令行里模拟发送消息、接收回复、甚至重启服务。

这样一来,闭环就通了

  • AI 写完代码,直接在命令行跑 E2E 测试。
  • 发现回复不对,AI 自动读取日志,反思并修改。
  • 修改完再跑,直到测试通过。

全程无需人工介入。AI 可以一次性持续工作,产出逻辑完整、经得起验证的插件。

实际效果

需求:开发一个钓鱼游戏小插件,包含尽可能多的鱼类品种;拥有稀有度系统、金钱系统、概率系统、钓鱼工具系统;通过聊天进行文字交互;支持用户信息记录和签到功能。

image-20260407172401393

左侧为 CLI 测试平台,右侧为 Claude Code 正在自主测试与修复

image-20260407172412161

AI 自主工作 35 分钟,最终通过所有测试用例,且通过端到端测试,还有写其他插件的时候经常就是 AI 自己工作一个小时左右直接产出可用的项目。

对比之前写几分钟就要让我交互一次,写完了还得让我自己手动测试,无穷的调试,提升很明显了。


三:重构代码

功能跑通后,但是代码可能并不是那么易于阅读,且有安全性的问题。为了让 AI 写的代码易于阅读,这时进入重构阶段。

方法:预设问题清单,让模型带着问题审查代码

这一阶段能稳步推进的关键在于模型的一个能力 —— 我自己称之为非退化性

非退化性:模型带着一个具体问题审查代码时,不会把正常代码误判为问题,同时能准确识别出真正有问题的代码。

看上去并不是一个很特殊的能力,但是这个能力就能保证 AI 最后一定能够写出好的代码。且看我的论证。(个人学数学的,比较喜欢论证)

推论

当模型具备非退化性时,可以进行如下论证:

  1. 单次审查:带着某个具体问题审查代码,AI 总能找到可以改进的地方
  2. 多次迭代:每次修改后,该类问题的出现次数递减
  3. 收敛性:经过多轮审查,代码在该维度上的问题代码趋于零 (并不一定真正趋于零但是能解决掉大部分问题),代码在这个问题上对 AI 来说变得 "平滑"—— 不再有突兀之处。这样就算解决了这个问题。

这样做的时候还有一个好处,就是能够让模型聚焦,聚焦于具体的问题从而能够让 AI 更加细致地理解代码。

进一步,如果 每一个问题的解决,都不会导致新的问题

那么就可以进一步推导:如果预设了足够多维度的重构问题,且一直反复去让 AI 带着相同的问题去重构,最终重构后的代码就会在所有这些维度上都达标 —— 也就是高质量的代码。

那能否实现呢?

答案就是前面开发阶段所使用的测试用例,通过构建一个安全网,每一次重构都必须基于已有的代码的质量不会降低,那么非退化性就能保证代码始终在向一个变好的方向迭代。

操作方法:

  1. 构建安全网:确保之前的单元测试和 E2E 测试覆盖了关键逻辑。
  2. 预设问题清单:在 CLAUDE.md 中列出重构问题 (如 SOLID 原则、DDD 分层、防御式编程等)。
  3. 迭代优化:让 AI 对照清单逐项优化。(当然有时候 AI 并不能思考的全面,可以自己复制具体问题去反复让 AI 审查) 由于有测试集兜底,任何破坏逻辑的修改都会让测试集跑不通, AI 必须始终保持测试集可以跑通 。

总结

这套方法论中,最关键的投入在于:

针对你的项目特性,构建一个能让 AI 操作的 CLI 平台。

image-20260407172420728

虽然这需要初期的一点开发成本,但它赋予了 AI 端到端测试的能力,从而可以极大解放开发者。这块属于基础设施的建设。


稍微一点点对模型选择上的看法

我们可以从中看出并不是需要非常强的模型才能写出好的项目,理论上来说模型只要会做题,那反馈循环,非退化性就能保证模型最后一定能写出足够好的代码。

按照这个想法,理论上一个中等的国产模型,只要会做题,稍微会写代码,那就能通过这个反馈循环直接产出好的代码。(可能有点乐观)

那为什么我们还需要更好的模型呢?

就在于能够更高效的 “做题”,能够对非常复杂的问题进行建模,能够根据长上下文,根据日志分析解决问题的能力。倘若一个模型分析能力有限,那遇到 bug 就不一定能够解决,会陷进里面,反复无效的思考。


不断从经验中学习

在一遍遍 Vibe Coding 到红温的过程中,我意识到我不应该在低效的 Vibe Coding 上浪费时间。我应当从经验中分析,去不断优化方法,不断提高效率,才不会在原地一遍遍重复浪费时间的行为。


附:提示词参考

下图展示了如何引导 AI 遵循这套流程。(随手写的,却能够确确实实起到很大效果)

image-20260407172427873

注:提示词并不需要写的有多么高大上,关键的是如何引导 AI 高效的工作,关键的是其中的思想

相关文章
|
2月前
|
人工智能 自然语言处理 测试技术
Vibe Coding实战:冗长提示词不是关键,工程约束才是落地核心
vibe coding不是拼提示词话术,而是以工程规范约束AI:预设基线、结构化拆解需求、分模块开发、强制配套测试、日志驱动修复。8个商业项目验证,标准化五步法可将接口开发从86分钟缩至26分钟,兼顾效率与可维护性。(239字)
543 2
|
存储 移动开发 ARouter
Android组件化开发,从未如此简单
组件化方式的开发,有很多的文章去阐述,而本篇的特点,在于有实际的组件化实战代码,有开源的组件化Demo样例,重在浅显易懂,重在能够应用于实际业务,也重在简单。
839 0
|
4月前
|
人工智能 自然语言处理 安全
Claude Code 全攻略:命令大全 + 实战工作流(建议收藏)
本文介绍了Claude Code终端AI助手的使用指南,主要内容包括:1)常用命令如版本查看、项目启动和更新;2)三种工作模式切换及界面说明;3)核心功能指令速查表,包含初始化、压缩对话、清除历史等操作;4)详细解析了/init、/help、/clear、/compact、/memory等关键命令的使用场景和语法。文章通过丰富的界面截图和场景示例,帮助开发者快速掌握如何通过命令行和交互界面高效使用Claude Code进行项目开发,特别强调了CLAUDE.md文件作为项目知识库的核心作用。
49569 72
Claude Code 全攻略:命令大全 + 实战工作流(建议收藏)
|
1月前
|
人工智能 前端开发 Shell
loop 最佳实践:从 /goal 到 /loop,让 Agent 工作流循环起来
本文详解Coding Agent的四种核心循环模式:基于轮次(人工驱动)、目标导向(/goal)、时间触发(/loop与/schedule)及主动循环,强调Agent工程的关键在于明确“谁触发、何时停、如何验”,而非仅优化Prompt。
259 0
loop 最佳实践:从 /goal 到 /loop,让 Agent 工作流循环起来
|
2月前
|
人工智能 自然语言处理 安全
Vibe Coding实战:Prompt技巧无用,工程规范才是核心学习方法
本文揭秘Vibe Coding高效落地的核心:工程规范先行,而非堆砌Prompt。基于8个实战项目,提炼出“规则定义→需求拆解→分层生成→质量校验→迭代优化”五步标准化流程,并推荐原生支持Agent与工程约束的TRAE工具。告别返工,实现可上线、可迭代的AI协同开发。(239字)
306 0
|
9月前
|
人工智能 数据可视化 前端开发
震惊,Github开源,真正让程序员效率提升 90%的AI辅助工具来啦!!!
Claude Code Viewer 是一款开源浏览器工具,将 Claude Code 的终端日志可视化,支持会话管理、Git Diff 查看、文件预览与定时任务,实现远程交互与多项目导航,提升 AI 编程效率。
2607 0
|
2月前
|
NoSQL Java Redis
看了就赚:2026大厂数据库、Redis、JVM三连杀高频考点(含真实面经)
本文深度解析2026届大厂后端面试新趋势:数据库、Redis、JVM已成“三连杀”必考项。不考死记硬背,而重机制理解、故障定位与工程权衡。通过MVCC版本链、Redis混合持久化、G1回收逻辑等本质拆解,结合真实故障案例与可落地的三项实战建议,助你从“会用”进阶到“懂因、能断、可治”。
|
5月前
|
人工智能 安全 测试技术
我给 OpenClaw 杀了 47 次僵尸进程,终于想明白了一些事
本文深度剖析OpenClaw:既吐槽其Gateway单点故障、钉钉通道集成缺陷与稳定性痛点,也肯定其“个人AI助理”叙事成功;对比本地开源(OpenClaw)与云端沙箱(Manus)路径,反思Skill模式与传统工程化取舍,并指出AI能写代码,但架构、产品与安全仍需人来把关。
我给 OpenClaw 杀了 47 次僵尸进程,终于想明白了一些事

热门文章

最新文章