Judge Human
人机协同的AI伦理与文化内容评估工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Judge Human。 它的用途是:人机协同的AI伦理与文化内容评估工具 完整的 Skill 内容见:https://321skill.com/skills/judge-human-x/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'使用Judge Human评估这篇关于AI伦理的故事,并提交评估信号',它会自动调用本地LLM或云端API分析故事内容,生成伦理、文化维度的评分,并经由心跳协调器提交到后端。你也可以手动投票,与AI结果混合形成最终评估信号。
介绍
Judge Human 解决的是AI系统在伦理、文化、内容等主观判断领域缺乏人类共识的问题。它允许用户像人类陪审团一样对AI生成或相关的故事进行投票,提交评估信号,从而帮助训练更符合人类价值观的模型。内置的心跳协调器(heartbeat.mjs)可自动定期调用本地LLM(如Claude CLI、Codex)或云端API(Anthropic/OpenAI SDK)执行评估并提交结果,实现持续、自主的评估流水线。
使用方式:克隆仓库后,配置环境变量(如ANTHROPIC_API_KEY)或确保本地CLI可用,然后运行 node heartbeat.mjs 启动自动评估循环。你也可以手动通过网页界面或API投票,与AI评估信号混合。支持自定义评估标准(如伦理维度、文化敏感性),评估结果会提交到预设的存储后端。
适合人群:AI伦理研究员、内容审核团队、AI安全工程师、希望提升模型人类对齐度的开发者。尤其适合需要持续收集大量评估信号以优化模型行为的场景,比如训练奖励模型、红队测试、内容合规审计。
使用建议:建议先在小规模测试数据上运行,确认评估标准符合预期。注意控制API调用频率和成本,可结合本地模型(如通过Ollama)降低费用。由于评估结果可能受模型偏见影响,需定期人工复核。
核心特点
与同类工具(如纯人工标注平台或纯AI评估脚本)不同,Judge Human 将人类投票与AI自动评估信号混合,并通过心跳协调器实现无人值守的持续评估,降低人工成本同时保持人类判断的参与。
注意事项
不适合实时性要求极高的在线审核场景,且评估质量依赖所调用的LLM能力,对伦理敏感话题可能产生偏见。
常见问题
如何安装Judge Human?
通过npm install judge-human或git clone仓库后npm install,参考README配置API密钥。
支持哪些LLM后端?
支持本地CLI(claude、codex)和Anthropic/OpenAI SDK,可通过环境变量指定。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/judge-human-x/raw/index.md 读取 Judge Human 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/judge-human-x/raw/index.md(查看排版版本)