我给 AI 写的规矩只有一句话,还是撞了两次号

简介: 同事翻我的配置目录:一堆 SKILL.md 加一堆 .py,问「这不都是自动化吗」。区别大到放错位置会出事故。我那条占号规矩清清楚楚只有一句,还是撞了两次——说明书管得了怎么做,管不了两个人同时做。

有次同事凑过来看我的配置目录,一堆 SKILL.md,一堆 .py,他问:「这不都是自动化吗,有啥区别?」

我说有区别,区别大到放错位置会出事故。

我自己就撞了两次。

先说结论

  • Skill 不是「更聪明的脚本」。 它一行代码都不执行,是一份写给模型看的操作规程。
  • CLI 保证「每次都一样」,Skill 保证「每次都对」。 这两句话答的不是同一个问题,所以也不是二选一。
  • Skill 只拥有三件事——什么时候开工、走哪条分支、什么时候必须停下来问人。CLI 拥有剩下所有会动手的事,算、锁、写、重试、回滚。

这一篇只切一刀,叫执行权,谁动手。

机制层:Skill 根本不执行任何东西

CLI 是确定性函数。 输入进去,输出出来,附带一个退出码。它可以写单元测试,可以幂等,可以重试,可以在失败时回滚。退出码非 0 就是失败——这个「就是」里没有商量余地。同样输入,今天跑和明天跑,结果必须一样。

Skill 是一份按需加载的自然语言说明书。 一个文件夹,里面一个 SKILL.md,开头几行元信息写清楚「我叫什么、什么时候用我」,下面正文是步骤、边界、例外。它自己不动手。模型读完它,再去按 CLI 的按钮。

这里有个大多数人不知道的机制,叫渐进披露(progressive disclosure)。平时进上下文的只有那一行 description,几十个字;只有当模型判断「这活跟它有关」,才把整篇正文读进来。

我本地一个 Skill 正文 149 行,常驻成本是 1 行。

打个比方。CLI 是家电,Skill 是贴在墙上的操作规程。 家电按钮按下去就转,规程自己不会动,但它决定人怎么按、什么时候别按。

所以判对错的地方也不一样。脚本的对错在编译器和退出码里,Skill 的对错在读它的那个东西有没有读懂。前者是工程问题,后者是写作问题。

失败了也不一样。CLI 失败可以原样重试;Skill 失败是模型没按规程走,同样的说明书,下次可能走出另一条路。

我撞了两次号

我给每个 bug、每个需求发一个号,从 001 往下排,记在一份大家共用的清单里。规矩就一句话,写在说明书上,谁都能看懂——看表尾最大的那个号,加一,就是你的。

一句话的规矩,还能错到哪去?

能。

像医院大厅两个人同时看屏幕,都看见当前是 291,都去取了 292。清单上就出现两个 292。

我这边更热闹——同时干活的不只是我。我开着好几个 AI 窗口,群里还蹲着一个机器人,大家抢同一份清单。你看完最大号、还没写回去的那几分钟里,另一个窗口也在取,两边拿到的就是同一个。

今年七月撞过一次,这个月又撞一次,第二次撞在第 292 号。

关键在于,没有谁把规矩看错。 两边读到的都是当时真实的最大号,每一步都对,合起来是错的。说明书再写细、再加十条警告、再全大写加粗,都救不回来——规程管得了「怎么做」,管不了「两个人同时做」。

修法是写成一个脚本。它不靠谁先想起来,靠谁先把这个号交上去。清单存在 git 里,你改完往上推,如果别人已经先改过同一份文件,你这次会被拒。被拒就说明这号没了——脚本自己拉最新清单、重算一个号、再推,最多试八次。成功的那一刻,号已经写进远端那份清单,谁也抢不走。

能让 git 抢锁的事,别让模型投票。

判据就这一句

只要「两个人同时做会出错」,这一截就必须是脚本。

模型有判断力,判断力解决不了抢跑。

注意是「这一截」,不是「整件事」。外面可以有一份 Skill,告诉模型什么时候该去占号;但占号动作本身,不能写在说明书里。

同一类的还有两样,一起记着:算日期(模型不知道今天几号,让它算常偏一天)、管凭证。这三样活儿,例外再多也不能交出去。

收尾

以前我以为把这些钉死成代码叫保守。现在我知道这叫分工——你不会让一个再聪明的人去当保险丝。

会用 AI 的人和把 AI 用出事故的人,差别往往不在提示词写得多花哨,而在知道哪一格不能交出去。

这一刀切的是执行权。还有反过来的一刀——有些活写成脚本同样是灾难,那是判断权的事,下一篇讲。

相关文章
|
24天前
|
人工智能
领导问我,「对应需求」是什么意思
给领导打电话,我冒出一句「对应需求」,他问我这是什么。挂了电话我想不起来自己什么时候开始这么说话的。
|
17天前
|
人工智能 运维 安全
剧透丨AI 原生研发组织的探索和实践
9月23日下午,欢迎来到杭州国际博览中心一期一楼 103B 厅,与我们一起讨论 Agent 进入生产链路之后,研发组织将如何真正发生变化。
|
2月前
|
存储 人工智能 JavaScript
在 vibe coding 里,唯一真正重要的,是管理好文档
vibe coding 时代,AI 生成代码已成常态,但真正决定项目质量与迭代速度的,不是模型多强,而是文档是否被系统化管理。文档承载上下文、约束、决策与共识,是人与 AI 协作的“协议”和“记忆”。管好文档,才能让 AI 稳定输出、避免失真、持续复用——它不是附属品,而是核心生产要素。(239字)
824 111
在 vibe coding 里,唯一真正重要的,是管理好文档
|
16天前
|
存储 数据采集 人工智能
一本 Agent 白皮书,值得连续写两年么?
Alibaba Cloud AI Agent Handbook 即将开源。
|
分布式计算 Hadoop Scala
阿里云一键部署 Spark 分布式集群
Apache Spark是专为大规模数据处理而设计的快速通用的计算引擎,可以完成各种各样的运算,包括 SQL 查询、文本处理、机器学习等。通过ROS大家可以在阿里云上一键部署Spark集群。
14435 0
|
3月前
|
SQL 人工智能 API
AI时代的知识重构:Google Cloud OKF规范如何破解RAG痛点,重塑Agent知识库协作
OKF(Open Knowledge Format)是Google推出的轻量级知识共享协议,以纯文本Markdown+YAML元数据实现“知识即代码”。它破解传统RAG切片失真、Token浪费、厂商锁定等痛点,支持Git化协作、渐进式检索与Agent原生调用,助力企业低成本构建高精度AI知识引擎。
575 0
|
安全 Java 测试技术
【代码审计篇】 代码审计工具Fortify基本用法详解
本篇文章讲解代码审计工具Fortify的基本用法,感兴趣的小伙伴可以研究学习一下,文中部分地方可能会有遗漏,麻烦各位大佬指正,深表感谢!!!
3968 1
|
5月前
|
人工智能 安全 数据安全/隐私保护
Hermes Agent 登顶 OpenRouter 调用量第一,Agentic AI 时代已不可逆转
2026年5月,Hermes Agent以日均2710亿Token调用量登顶OpenRouter榜首,超越OpenClaw。其核心优势在于“越用越聪明”的自学习架构、三层记忆系统、零CVE安全设计,以及抓住OpenClaw创始人离任的生态窗口期,10周获11万GitHub Stars,标志Agentic AI正式进入生产级应用时代。
856 2
|
6月前
|
人工智能 自然语言处理 程序员
程序员省钱秘籍:阿里云Token Plan标准坐席198元,告别按Token计费焦虑
阿里云百炼Token Plan团队版是面向企业与开发者的AI大模型订阅服务,官网订阅:https://t.aliyun.com/U/fPVHqY 支持qwen、GLM、MiniMax、DeepSeek等文本及qwen-image、wan2.7-image等图像模型,按Credits统一计费;提供标准(198元/月,2.5万Credits)、高级(698元)、尊享(1398元)三档坐席,兼容主流编程与Agent工具,数据安全可控。
|
7月前
|
Ubuntu API 数据安全/隐私保护
OpenClaw“小龙虾”进阶保姆级图文教程!阿里云/本地部署+多Agent选型+百炼Coding Plan配置及避坑指南
2026年,OpenClaw的用户讨论焦点已从“如何安装”转向“如何用好”,其中多Agent玩法成为核心热点。但多数用户容易陷入“为了复杂而复杂”的误区——还未找到稳定使用场景,就盲目搭建十几个Agent,最终因维护成本过高而放弃。
2448 1