别急着让 AI 写代码,先让它把这些问题问清楚

简介: 最近我越来越怕一种场面。 你让 Agent “做一个会员系统”,它一句问题都不问,转身就开始写。数据库表有了,支付接口接了,页面也挺漂亮。半小时后,它端出一套完整系统,唯一的问题是:这不是你想要的会员系统。 代码报错反而好办。错误需求被高质量实现,才是真的费钱。 Agent 太能干以后,含糊会变得更

最近我越来越怕一种场面。

你让 Agent “做一个会员系统”,它一句问题都不问,转身就开始写。数据库表有了,支付接口接了,页面也挺漂亮。半小时后,它端出一套完整系统,唯一的问题是:这不是你想要的会员系统。

代码报错反而好办。错误需求被高质量实现,才是真的费钱。

Agent 太能干以后,含糊会变得更危险

以前需求没说清,开发会停下来问:按月订阅还是一次买断?谁能取消?退款怎么算?

现在模型补全能力越来越强。你没说的部分,它会根据“常见做法”自动补上。每一个选择单看都合理,拼起来却可能完全偏离业务。

这也是 Matt Pocock 那套工程 Skills 里,我最喜欢 grill-me 的原因。它不是让 Agent 更快开工,而是强迫它在开工前,把真正需要人拍板的决策问出来。

事实能查的,让 Agent 自己查。只有业务取舍、风险偏好和验收标准,才交给人决定。

先问清楚,再把共识钉住

一轮需求澄清不能只留下聊天记录。

对话很长,模型会遗忘;换一个 Agent,理解又会漂移。更稳妥的做法,是把确认后的内容沉淀成一份规格说明:解决什么问题,谁会使用,哪些行为算成功,哪些明确不做。

这里最重要的不是文档格式,而是“决策不可偷偷变化”。

比如会员系统至少要钉住这些问题:

  • 商品是订阅、买断,还是两者都有;
  • 权益在哪一刻生效,又在哪一刻失效;
  • 退款、取消和续费失败如何处理;
  • 管理员可以做什么,普通用户不能做什么;
  • 哪几条流程必须用自动化测试证明。

需求一旦写成规格,后面的任务拆分、开发和评审才有共同的尺子。

不要横着铺功能,要竖着打通一条路

很多项目的任务清单看起来很专业:先建所有表,再写所有接口,再做所有页面。

这种拆法的问题是,做了两周仍然没有一条完整流程能跑通。到最后才发现支付状态、权限模型和前端交互根本对不上。

更实用的方式是“竖切”。先用最小范围打通一条真实路径:用户购买一个方案,支付成功,权益生效,后台能查到记录。跑通以后,再扩展退款、续费和多方案。

这样每一小步都有可见结果,也能更早暴露错误假设。

评审要分两条线

Agent 写完代码以后,评审不能只问“能不能运行”。

第一条线是工程标准:有没有明显安全问题,错误处理是否完整,测试是否可靠,代码是否可维护。

第二条线是需求符合度:它实现的是不是规格里约定的东西,有没有偷偷加戏,有没有漏掉边界。

这两条线必须分开。代码写得再漂亮,做错了需求也不能合并;功能看起来能用,安全和回滚没有着落,同样不能上线。

我现在会先给 Agent 一道刹车

以后遇到稍复杂的任务,我会先加一句:

在我确认需求之前,不要修改文件。先列出会影响方案的关键决策;能通过代码、文档或公开资料确认的事实请自行调查,只向我询问必须由业务方决定的问题。最后把确认结果整理成规格,并列出明确不做的范围。

这句话不会让模型变笨,恰恰相反,它把模型的能力放在了更值得用的地方。

AI 写代码越来越快,人的价值就更靠前了:定义问题、做取舍、设边界、验结果。

真正成熟的工作流,不是让 Agent 一收到命令就冲出去,而是让它知道什么时候必须先停下来。

相关文章
|
21天前
|
人工智能 机器人 BI
AI 明明能做,为什么还要保留一些工作给人
比尔·盖茨最近提出了一个词:Human Reserved,可以译成“人类保留岗位”。 它听上去有些反直觉。机器如果做得更快、更便宜、错误更少,为什么还要限制使用?过去两百年的技术进步,不就是不断把重复劳动交给机器吗? 盖茨提出的不是能力判断,而是社会选择。有些工作即使机器能够完成,人仍可能决定不把它
AI 明明能做,为什么还要保留一些工作给人
|
22天前
|
人工智能 运维 数据库
企业知识库资料越多,Agent 为什么反而越容易答错?
本文导读 引用能够打开、数字也能在原文中找到,并不代表答案适用于今天的版本和现场。本文拆解“带证据的过期答案”为什么难查,并给出一套同时检查来源、时间、状态、冲突与现场的验证方法。 这类错误最难发现。 AI 给出的链接能打开,引用内容也确实存在,甚至每一个数字都能在原文中找到。你检查一圈,以为这次终
企业知识库资料越多,Agent 为什么反而越容易答错?
|
1月前
|
SQL 人工智能 测试技术
SDD 工程法实战:用 AI 按规格开发一个真实项目
源码:https://github.com/NyaRu-Kiss/SDD-Research_AgentSDD(Spec-Driven Development,规格驱动开发)是一种先写清规则、需求和技术设计,再让 AI 执行代码的开发方法。它适合 AI 辅助开发,因为 AI 的执行速度…
|
22天前
|
人工智能 BI 数据库
一人公司最容易死在第一步:先做产品,再找客户
AI 把做产品的成本打下来了。 一个人可以写代码、做页面、生成视频、接支付,过去要一个小团队忙几个月的事情,现在周末就能搭出第一版。 于是“一人公司”开始流行。很多人的第一步也出奇一致:先做一个产品,然后去网上寻找需要它的人。 这一步,往往正是死亡的开始。 能做出来,不代表有人愿意付钱 产品优先的路
|
20天前
|
缓存
阿里云Token Plan的Credits是如何计费的?1个Credits相当于多少Token?
阿里云百炼Token Plan采用动态Credits计费,1 Credits不固定对应Token数,实际消耗由模型类型、Token用量、思考模式及工具调用等共同决定。以qwen3.6-plus为例,输入/缓存/输出Token折算系数各异,百万Tokens成本低至1.12元,较按量计费最高省44%。新用户赠7000万Tokens。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
22天前
|
安全 Windows
如何取消Windows系统对软件的拦截下载?
本文详解Windows下载安装包被拦截的4种常见情况及安全应对方案:SmartScreen警告、浏览器阻止下载、Defender误删、IE/Edge下载失败等,提供无需关闭防护即可解决的官方推荐方法,兼顾安全与便捷。(238字)
|
24天前
|
人工智能
Qoder 科研提效专场,9月2日开讲!
本期科研提效专场邀请两位AI4S领域博士生,分享如何用Qoder加速科研:李瑀旸详解“Agent for Science”设计与验证全流程;王世琦演示用Qoder高效搜资料、理逻辑、优表达。真实案例拆解,零编程基础可上手。
130 0
|
1月前
|
人工智能 IDE 安全
阿里云Qoder CN全解析:AI编码智能体全场景功能深度指南
阿里云Qoder CN(原灵码)是阿里云推出的全栈式AI智能体产品系列,定位为覆盖编码、办公、终端、云端的一体化AI开发与协作平台,以多模态编程、智能体自主执行、全端覆盖、企业级安全合规为核心优势,深度适配国内开发者与企业的研发、办公、运维全流程需求。平台内置多模型自由切换、工程级代码处理、智能体任务编排、多模态交互、企业知识库集成等核心能力,提供桌面IDE、JetBrains插件、CLI终端、云端智能体、桌面办公助手等全形态产品,实现“一个账号、全场景覆盖、Credits共享”的一体化体验,是国内领先的AI编码与智能体协作平台。本文从产品矩阵、核心能力、全端接入、实战代码、企业级特性、订阅方
513 2