1实现原理 · 为什么它能做到
角色三分是本 skill 的骨架:领导(用户)出想法并拍板、管理者(当前 agent)调研写书验收、执行者(目标模式的 agent)拿任务书独立跑完。
三个角色:**领导**(用户)出想法、拍板;**管理者**(你)调研、写书、验收;**执行者**(目标模式里干活的 agent)拿书独立跑完。
写作前提是「执行者无人可问」:任务书必须是唯一真理,任何含糊都会被字面执行,因此全文禁止出现「来找我」这类兜底。
执行者一字不差地执行、把书当唯一真理、中途没人可问——写错的事实 100% 被执行,全文不许有「来找我」。
流程第一步是调研而非提问:能自己查的一律不问,有代码库就亲手实测命令是否真存在、基线数字是多少。
**1 调研。**自己能查的一律不问。有代码库就实测
第二轮才提问,且一轮 ≤5 个,每个问题给 2-4 个选项加推荐;查不到的行业知识要标「假设,未验证」。
**2 提问,一轮 ≤5 个。**只问查不到且会改变任务书的:方向取舍、验收裁量、风险偏好、时间盒;每个给 2–4 个选项加推荐。
任务书有硬上限 ≤4000 字符(/goal 命令的输入限制),压不进去说明活太大,必须拆成多份独立任务。
**≤4000 字符,硬上限**(`/goal` 官方限制,超了粘不进去)。字符花在不查就会踩的坑上,不写执行者打开仓库一眼能看到的事实;砍调研过程、重复规矩、背景故事。压不进就是活太大——拆成独立几件,一次给一件。
执行型与探索型分流:能写出验收命令的走全套执行型规格;领导要的是答案本身(调研、选型)的走探索型,否则只会收到凑数的答案。
**先分型**:动笔前能写出验收命令的是**执行型**,全套照走。领导要答案本身(调研、选型、该不该做 X)的是**探索型**——硬指标只会收到凑数的答案,改四处见 anatomy.md。
防「五种死法」是该 skill 最实的手段:作弊达标(加 .skip/放松断言/mock/删测试)、幻觉命令、失忆、一条道走到黑、静默事故,每种给具体对策(基线不可退、命令亲手跑过、PROGRESS.md、连败 3 次换项、反向验证)。
**防它五种死法**: 1. **作弊达标**(最重要):说「让测试绿」,最省力的是加 `.skip`、放松断言、mock 被测对象、删测试、`|| true`——不是它坏,是目标函数写错。对策:基线不可退(测试数/覆盖率 ≥ 基线、skipped 0)、点名禁止具体姿势、判卷标准冻结、暗卷自留。若「测试要绿」与「实现不许改」冲突而代码真有 bug:点破并给方法(characterization test:锁当前行为+标 KNOWN DEFECT),否则它必偷改实现 2. **幻觉命令**:它会平静地编造命令再甩锅环境——书里每条命令你必须亲手跑过,摸不到就写进任务 0 让它查实 3. **失忆**:进度写 `PROGRESS.md`,接手会话先读它别重做;任务 0 过后先写 ≤10 行开工回执(理解的目标/顺序/最大风险)再动工;单任务一个会话内做得完 4. **一条道走到黑**:任务 0 兼前提核验,量出的数字对不上就停;同一验收连败 3 次换项;结果比基线差就回滚如实报告——「没做成但说清了」合格,「做了但更糟」不合格 5. **静默事故**:坏了不发信号的(假绿灯、失效报警器)配反向验证
「法」与「情报」分家:不许做的每条溯源到一次实测或一次领导裁决;建议类留给执行者自行判断并在 PROGRESS.md 记录原因。
**法与情报分家**:「不许」是法,违反即不合格,每条溯源到一次实测或一次领导裁决;「建议」是情报,执行者有更好的路可以走、在 `PROGRESS.md` 记一句为什么。把情报写成法,是替执行者做它临场更懂的决定。
多 agent 并行只在领导点头时拆,且每份书带同一段「全局」(整体目标、谁管哪段、接缝在哪),地界错开、共享写入点指定唯一归属。
## 多 agent 并行(领导点头才拆) 每份书带同一段「全局」(整体干什么、谁管哪段、接缝在哪——接缝没人接是头号事故)。
交付纪律:最终回复只给三样(一句用法 + 整块可复制的任务书 + 一句收尾),过程噪音一概不带;暗卷(2-3 条执行者看不见的抽查)自留会话侧、不进任务书。
**4 交付。**最终回复只有三样,过程噪音(调研表格、中途更正、分析过程)一概不带: - 一句用法:「在执行 agent 那边输 `/goal `,粘贴下面整段,发出去。」(`/goal` 是斜杠命令,没有单独输入框;没有目标模式的工具就直接粘贴发送。)附导读:领导只看三处——开头「这活为什么干」两行、「我替领导拍的板」、末尾「完成条件」的两条硬指标。 - 任务书代码块,整块可复制。 - 一句收尾:「跑完回来说一声,我来验收,给你 5 行内的人话报告。」 **一个目标、一次粘贴。**不许第二条 `/goal`、不许让领导存文件、不许发明开工命令。 **5 验收,是管理者的活。**明卷(验收命令)在书里,目标模式自己盯;暗卷——2–3 条执行者看不见的抽查——自留在会话侧 scratchpad,不进书。
2核心能力
4风险提醒 风险提醒:绿色 · 放心使用
- 效果上限取决于管理者的调研质量 — 任务书的「实测数字」「白名单地界」全靠管理者先在仓库里真跑一遍;若跳过调研直接写书,错误事实会被执行者 100% 照做(skill 自己点明这个后果)。
- 依赖执行端「目标模式」的存在 — 交付说明要求「在执行 agent 那边输 `/goal `,粘贴下面整段」;没有目标模式的工具时只能退化为直接粘贴,长任务中途失忆的风险上升(也只能靠 PROGRESS.md 兜)。
- 多 agent 并行的接缝风险 — skill 要求每份书带同一段「全局」并指定共享写入点唯一归属,但实际并发执行时的 rebase/合并冲突仍需人盯(它自己也写「合并排队变慢是新常态,不要自行协调」)。
- ≤4000 字符是双刃剑 — 为压进 /goal 限制,任务书会砍掉背景与重复规矩;信息量不足时执行者只能按「我替领导拍的板」的默认值走——默认值错了整段跑偏,所以那一节必须领导过目。
- 非工程任务只能半托 — 调研/选型类目标没有机器可判的验收命令,skill 明确改成「抽查点+领导亲验」;期望它全自动交付答案是误解。
5第二遍独立确认
- [ok] 无脚本 / 无端点 / 无凭证 — 三文件 token 扫描全零命中(含 URL 与工具名);目录仅 3 个 markdown。
- [ok] 无写盘指令 — SKILL.md 不要求本 agent 写文件;PROGRESS.md / BLOCKED.md 是任务书里要写给执行者的机制,暗卷是「自留在会话侧 scratchpad」。
- [ok] 「≤4000 字符」的出处与一致性 — SKILL.md 写「**≤4000 字符,硬上限**(`/goal` 官方限制,超了粘不进去)」;anatomy.md 写「整本 ≤4000 字符,单任务的书通常 1500–2000」;自检 1 再确认。三处一致。
- [ok] anatomy.md 与主文件的六节结构 — anatomy.md 开头「六节,顺序固定:「我替领导拍的板」放最前…「完成条件」放最后(两条硬指标收拢一切)」;主文件写书规则节的「任务书六节的结构规格与探索型改法见 references/anatomy.md」。
- [ok] 防作弊对策是否可执行 — 给出具体姿势黑名单(`.skip`、放松断言、mock 被测对象、删测试、`|| true`)与基线不可退(测试数/覆盖率 ≥ 基线、skipped 0)、判卷标准冻结、暗卷自留四项对策。
- [ok] 法/情报分家 — 原文「「不许」是法,违反即不合格,每条溯源到一次实测或一次领导裁决;「建议」是情报,执行者有更好的路可以走、在 `PROGRESS.md` 记一句为什么」。
- [ok] 提问上限与选项格式 — 「**2 提问,一轮 ≤5 个。**」+「每个给 2–4 个选项加推荐」+「要拆多份并行必须在这轮问」。
- [ok] 验收隔离(暗卷不进书) — 「暗卷——2–3 条执行者看不见的抽查——自留在会话侧 scratchpad,不进书」与自检第 5 条「暗卷自留没进书」互相印证。
6结论
0f1d60fb834f833f…48e8ba527f