subagent-testing

通过TDD在独立子代理中测试AI技能

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:subagent-testing。
它的用途是:通过TDD在独立子代理中测试AI技能
完整的 Skill 内容见:https://321skill.com/skills/subagent-testing-x-3/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'我想测试一下我刚写的“天气查询”技能,请用TDD方式在子代理里运行我的测试用例。',它会创建一个干净的测试子代理,加载你的技能和测试代码,并执行测试,最后反馈通过/失败的结果及详细日志。你也可以说:'为我的“数据解析”技能添加几个边界情况测试。',它会引导你编写新的测试用例并在子代理中验证。

介绍

这个Skill旨在解决AI技能开发过程中测试困难、难以保证质量的问题。它提供了一个框架,允许开发者在隔离的、全新的子代理环境中,以测试驱动开发(TDD)的方式对AI技能进行系统化测试。

使用方法通常是:在开发或修改一个AI技能后,通过该Skill创建一个临时的测试子代理,在其中编写并运行针对该技能的测试用例,验证其功能是否符合预期,确保技能在不同上下文和输入下的稳定性和准确性。

它非常适合智能体开发者、测试工程师以及任何需要确保其构建的AI技能可靠、无副作用的开发者。通过隔离测试,可以避免主代理环境被污染,专注于技能本身的逻辑验证。

使用建议是将其集成到你的技能开发工作流中,作为代码提交前的必要环节。注意事项包括:测试环境是临时的,测试数据需要妥善准备;对于高度依赖外部API或特定上下文的技能,可能需要额外的Mock或Stub设置。

核心特点

与直接在主代理中测试或手动验证不同,它强制在全新的、隔离的子代理中执行测试,更接近真实部署环境,能有效发现技能间的隐性依赖和副作用。同时,它明确倡导并支持测试驱动开发(TDD)模式,将测试作为技能开发流程的核心环节。

注意事项

不适合需要复杂持久化状态或与主代理深度绑定的技能测试,也不适用于非技能类的通用功能测试。

常见问题

这个Skill和普通的单元测试框架有什么区别?

它专为AI技能设计,在独立的子代理(类似沙箱)中运行测试,能模拟技能被用户实际调用的完整环境,而不仅仅是函数调用。

测试子代理会保留我的对话历史或配置吗?

不会,每次测试通常在一个全新的子代理中进行,测试完成后环境会被清理,确保测试的独立性和可重复性。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/subagent-testing-x-3/raw/index.md 读取 subagent-testing 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。