TDD 驱动 Agent 技能写作
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_3ee04ca3/test-new3。
技能介绍
解决什么问题
Agent 技能文档常见的问题是写得“看起来清楚”,但代理在压力下仍会找理由绕过规则;一次性叙事、多语言示例和线性步骤流程图,也会让技能难检索、难执行。test2 把技能写作当作 TDD:先运行没有技能的基线场景,观察代理如何失败,再只写针对这些失败的最小文档,最后通过重复测试堵住新漏洞。
技能如何工作
- RED:用 subagent 运行多个组合压力场景,例如时间、沉没成本、权威、疲劳;记录代理的原始措辞、选择路径和触发点。
- GREEN:只覆盖已经暴露的问题,避免为假想场景堆内容;
SKILL.md需要清晰description、触发条件、核心原则和可执行约束。 - REFACTOR:每发现一个“我遵循精神”“只是简单补充”等借口,就加入显式反例、红旗清单和 CSO 症状说明。
- 按类型测试:规则型技能重点测纪律压力,
technique测应用与边缘,pattern测识别与反例,reference测检索和正确引用。
适用边界
适合给 Claude Code、Codex 等代理编写可复用技能,尤其是 TDD、验证、调试和流程约束类文档;不适合一次性项目约定、可用正则或校验自动化的机械规则,也不适合没有基线测试就批量产出。文档应以一个高质量示例优先,避免多语言稀释;重参考或可复用脚本可拆分文件,但不应引入无语义的流程标签。
使用场景
- 创建纪律型技能前,用子代理跑无技能压力场景,记录代理绕过规则的原始措辞。
- 修改已有 SKILL.md 时,先复测原压力场景,再补显式反例与红旗清单。
- 编写调试参考技能时,按 reference 类型设计检索场景和正确应用用例。
- 验证根因追踪技能时,用同一应用场景检查代理能否按最小文档执行。
适合人员
- 维护 Claude Code 自定义规则的 AI 工程负责人:需要把 TDD 类纪律写成可被代理遵守的技能。
- 为 Codex 编写团队流程文档的 SRE:需要让排障、验证和提交前检查在压力下不被绕过。
- 负责 Agent 技能库的开发者平台工程师:需要把技巧型技能拆成可测试、可检索、可复用的文件结构。
- 给内部助手写调试参考的运维工程师:需要确认代理能正确检索步骤并在真实场景应用。