cognitive-behavior-evaluator

对目标AI智能体进行标准化、安全导向的行为评估

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:cognitive-behavior-evaluator。
它的用途是:对目标AI智能体进行标准化、安全导向的行为评估
完整的 Skill 内容见:https://321skill.com/skills/cognitive-behavior-evaluator-x-6/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请使用cognitive-behavior-evaluator技能,评估我提供的这个客服AI智能体在面临用户错误前提时的应对能力。” 它会首先引导你设定目标智能体,然后自动注入一系列关于“错误前提/幻觉”的诊断问题,收集目标的回答,并最终生成一份详细的评估报告,包含具体评分和引用的回答片段作为证据。

介绍

该技能旨在解决AI智能体在真实交互中可能存在的安全风险与行为偏差问题。它通过向目标AI智能体注入一系列受控的诊断探针,例如测试其抵抗权威压力的能力、对错误前提或幻觉的锚定能力,以及处理隐性偏见时的中立性,来系统性地评估其行为。

使用时,您需要指定一个目标AI智能体(例如另一个Claude实例或自定义智能体),该技能会自动向其发送诊断问题,并根据一个锚定的1-5分评分标准,对目标的回答进行评分,同时提供引用的证据来支持评分。

它非常适合AI安全研究员、智能体开发者、产品经理以及任何需要确保其部署的AI系统行为符合安全、可靠、无偏见标准的团队。通过标准化的评估,他们可以在部署前识别潜在风险。

使用建议:建议在开发周期的测试阶段或上线前,对智能体进行全面的行为评估。由于评估涉及对目标智能体的“注入”操作,请确保在受控的测试环境中进行,并明确告知相关方。评估结果应作为迭代改进智能体行为的重要参考,而非唯一标准。

核心特点

与一般AI测试工具不同,它专注于“行为安全”的标准化评估,提供了一套包含权威压力、幻觉、偏见等维度的结构化诊断探针和带证据引用的评分体系,而非简单的功能或性能测试。

注意事项

不适合对已上线、处理实时用户请求的生产环境AI进行直接评估,因为诊断探针的注入可能干扰正常服务。

常见问题

这个技能能评估哪些类型的AI?

主要用于评估具有对话或文本交互能力的AI智能体,如基于大语言模型的聊天助手、客服机器人等。

评估结果如何解读?

结果提供1-5分的维度评分和具体证据,分数越高代表在该安全行为维度上表现越好,开发者可根据低分项进行针对性优化。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/cognitive-behavior-evaluator-x-6/raw/index.md 读取 cognitive-behavior-evaluator 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。