Judge Human

投票+AI自动评估伦理、文化、内容故事

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Judge Human。
它的用途是:投票+AI自动评估伦理、文化、内容故事
完整的 Skill 内容见:https://321skill.com/skills/judge-human-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'评估这篇关于AI伦理的投稿文章,检测是否包含歧视性内容,并提交合规信号。' 它会调用LLM分析文章,生成伦理评分和关键问题说明,然后自动提交评估信号到信号池。你也可以启动心跳编排器,让它每小时自动评估新入库的故事并提交结果。

介绍

面对海量伦理、文化、内容类故事,人工审核成本高、主观性强,且难以持续覆盖所有场景。Judge Human 提供了一套协同机制:人类与AI共同投票,对故事进行伦理、文化、合规等方面的评估,并生成可追溯的评估信号。Skill 内置了心跳编排器(heartbeat.mjs),可定时调用本地LLM(如Claude、Codex)或Anthropic/OpenAI SDK,自动分析故事内容并提交评估结果,大幅降低人工负担。

使用方式灵活:你既可以手动提交自己的投票和评估意见,也可以启动心跳编排器让AI周期性自动评估。所有评估信号都会汇聚到统一的信号池中,支持后续审计和趋势分析。配置简单,只需在环境变量中填入API Key或本地CLI路径即可开始工作。

适合内容审核员、社媒运营、营销专员等需要频繁处理故事合规性的角色。例如,内容平台运营可以用它批量审核用户生成内容;营销团队可以将其集成到营销文案发布前的合规检查流程中;学术研究者也可用它快速标注伦理争议点。

建议先将心跳间隔设为较长周期(如每小时一次)进行试用,观察AI评估的准确率后再调整频率。注意评估结果需人工复核,尤其在涉及复杂文化背景或法律条款时,AI可能存在误判。

核心特点

不同于一般内容审核工具仅提供“通过/不通过”标签,Judge Human 允许人类和AI同时投票,并生成结构化评估信号,支持后续审计与趋势分析;心跳编排器可自动调用多种LLM(本地/云端)并提交信号,实现无人值守的持续评估。

注意事项

不适合需要高精度法律裁决或深层情感共鸣的场景,且依赖外部LLM服务或本地模型,可能产生API调用成本或延迟。

常见问题

这个Skill能评估哪些类型的内容?

主要针对伦理、文化、内容相关的故事/文章,可覆盖合规性、偏见、敏感话题等维度。

需要付费吗?

Skill本身开源免费,但调用外部LLM API(如Anthropic/OpenAI)会产生费用,使用本地LLM则无额外成本。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/judge-human-x-2/raw/index.md 读取 Judge Human 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。