subagent-testing

在全新子代理中通过测试驱动开发来验证技能

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:subagent-testing。
它的用途是:在全新子代理中通过测试驱动开发来验证技能
完整的 Skill 内容见:https://321skill.com/skills/subagent-testing/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘请使用TDD方式,在子代理中测试一下我们新开发的“数据摘要生成”技能,验证它处理长文本的准确性。’,它会创建一个临时的子代理,加载您的技能代码和预设的测试用例,运行后返回各项测试通过与否的结果报告。或者,您可以说:‘我刚修改了客服工单分类技能的逻辑,帮我在一个干净的子代理里跑一遍所有测试,确保没有引入回归问题。’

介绍

这个技能旨在解决智能体技能开发过程中,难以在隔离、纯净的环境中验证新技能或现有技能稳定性的问题。它通过创建临时的子代理环境,让开发者能够以测试驱动开发的方式,独立运行和测试特定的技能逻辑,确保其功能正确且不会对主代理环境造成污染。

使用方法通常是在需要验证某个技能时,通过调用该技能并指定测试目标,它会自动创建一个临时的子代理实例,在其中加载并运行相关的测试用例,最后返回测试结果。这类似于为技能运行一个独立的“沙箱”测试。

它非常适合智能体开发者、测试工程师以及任何需要在AI应用开发流程中引入严格质量保障的团队成员。当您开发了一个新技能,或者对现有技能进行了修改,希望在不影响主服务的前提下快速验证其行为时,这个工具尤为有用。

使用建议是,将其集成到您的CI/CD流程中,作为代码合并前的自动化测试环节。需要注意的是,由于它需要创建子代理,可能会消耗额外的计算资源,并且测试环境的配置(如模型版本、工具权限)需要与主环境保持一致以确保测试有效性。

核心特点

核心区别在于它专注于为AI智能体技能提供基于TDD的、隔离的子代理测试环境,而非通用的单元测试或集成测试。它直接模拟了技能在独立智能体实例中的运行状态,能更真实地反映技能在实际部署时的交互行为。

注意事项

不适合用于测试高度依赖主代理长期记忆或复杂上下文状态的技能,也不适合作为性能或压力测试的工具。

常见问题

这个技能和普通的单元测试框架有什么区别?

它专为AI智能体技能设计,在独立的子代理环境中运行测试,能模拟技能与AI模型、工具的真实交互,而不仅仅是测试纯函数逻辑。

使用这个技能需要提前编写好测试用例吗?

是的,它遵循测试驱动开发理念,需要您预先为待测技能编写好测试用例和断言,技能本身负责创建环境并执行这些测试。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/subagent-testing/raw/index.md 读取 subagent-testing 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。