prompt-guard

AI Agent运行时安全防护工具,防御提示注入等攻击。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:prompt-guard。
它的用途是:AI Agent运行时安全防护工具,防御提示注入等攻击。
完整的 Skill 内容见:https://321skill.com/skills/prompt-guard/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请帮我分析一下这段用户输入是否安全。”,它会调用Prompt Guard库对输入文本进行扫描,并返回一个包含风险等级(如CRITICAL)、触发规则和推荐动作(如BLOCK)的分析结果,帮助你决定是否拦截该请求。

介绍

Prompt Guard 是一款专为AI Agent设计的运行时安全防护工具,旨在保护Agent免受各类恶意攻击。它核心解决的是AI Agent在运行过程中可能遭遇的提示注入、供应链攻击、内存污染等新型安全威胁,确保Agent行为的安全可控。

该工具通过内置超过600条安全模式规则进行离线检测,无需联网即可工作。用户只需导入库并调用analyze方法,即可对输入文本进行安全分析,并根据配置的敏感度级别(低、中、高、偏执)采取记录、警告或拦截等不同动作。同时,它也提供可选的API服务,用于获取早期访问和高级检测模式。

Prompt Guard 非常适合AI Agent的开发者、安全研究人员以及任何在关键业务或敏感环境中部署AI Agent的团队。它帮助开发者在Agent上线前和运行中,主动发现并阻断潜在的攻击向量,降低安全风险。

与同类安全工具相比,Prompt Guard 的独特之处在于其专注于AI Agent运行时特有的攻击面,如针对Agent记忆文件(MEMORY.md)的投毒、利用Unicode字符的隐写术、以及通过恶意社区技能进行的供应链注入攻击。它将这些前沿威胁的检测模式进行了系统化集成,提供了更贴合AI Agent生态的纵深防御。

核心特点

核心区别在于其深度集成了针对AI Agent特有攻击面的600+条检测模式,特别是覆盖了供应链技能注入、内存投毒、Unicode隐写术等新兴威胁,并提供可选的云端API以获得更早、更高级的威胁情报更新。

注意事项

该工具主要基于模式匹配进行检测,对于完全新型、不在其模式库内的攻击手法可能存在漏报风险。

常见问题

Prompt Guard 需要联网吗?

核心功能完全离线,内置600+条规则。可选API用于获取更新和高级模式,但可手动关闭。

如何调整检测的严格程度?

通过配置文件中的`sensitivity`(低、中、高、偏执)和`pattern_tier`(关键、高、完整)参数进行灵活调整。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/prompt-guard/raw/index.md 读取 prompt-guard 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。