Judge Human

众包+AI协同评估内容伦理与合规

其他 社媒运营内容创作者学术研究者 审查AI生成内容监控AI响应 claude通用 ★ 1.9k 更新于 2026-08-01

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Judge Human。
它的用途是:众包+AI协同评估内容伦理与合规
完整的 Skill 内容见:https://321skill.com/skills/judge-human-x-6/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'启动心跳评估,自动拉取今天新增的50条用户生成故事,分别用Claude和GPT-4评估伦理违规风险,并汇总投票结果到仪表盘。' 它会运行 heartbeat.mjs 脚本,调用配置的模型逐个分析故事,生成包含风险等级、违规类型和置信度的评估信号,最后将结果存入数据库,供后续人工仲裁。

介绍

Judge Human 解决的是内容审核中单一 AI 模型判断偏差与人工审核效率低下的矛盾。它搭建了一个“人类+AI 混合投票”框架,让用户可以对伦理、文化、内容故事等敏感话题提交评估信号,同时内置一个自主心跳编排器(heartbeat.mjs),能够定时调用本地或云端大模型(如 Claude、Codex、Anthropic/OpenAI SDK)自动评估故事并提交信号,实现持续、去中心化的内容质量监控。

使用方式非常简单:部署后启动心跳脚本,它会自动拉取待评估故事,调用你配置的 LLM 接口生成评估信号,并上传到公共或私有信号池。你也可以手动通过界面或 API 对单条故事进行投票,与 AI 信号共同形成最终决策。系统支持自定义评估维度(如偏见、冒犯性、文化敏感性)和投票权重,适合需要灵活审核策略的团队。

这个 Skill 主要面向内容审核团队、社区运营人员、AI 伦理研究者以及需要确保生成内容合规的开发者。如果你正在运营一个 UGC 社区、AI 对话产品,或者需要定期审查大量 AI 生成内容,Judge Human 能显著降低人工审核成本,同时通过混合机制减少误判。

建议使用前先在小范围测试不同 LLM 的评估一致性,并设置合理的投票权重(例如人类投票权重高于 AI)。注意心跳脚本会消耗 API 额度,建议根据故事量调整轮询频率。另外,该工具不提供训练数据,评估标准需要你自行定义并写入配置。

核心特点

与单纯用 AI 做内容审核的工具不同,Judge Human 引入了“人类众包投票”机制,让 AI 信号与人类判断共同决策,且自带心跳编排器可自动定时触发评估,适合需要持续监控大量内容的场景。

注意事项

不适合对实时性要求极高的内容审核(如直播弹幕),因为心跳轮询存在延迟;且需要人工投票参与才能发挥最佳效果,完全自动化时可能继承 LLM 的偏见。

常见问题

Judge Human 支持哪些大模型?

支持本地 CLI(claude、codex)以及 Anthropic/OpenAI 的 SDK,配置灵活。

如何调整评估标准?

通过修改配置文件中的评估维度列表和提示词,可自定义伦理、文化、内容等维度的评判规则。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/judge-human-x-6/raw/index.md 读取 Judge Human 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。