evaluation-framework
加权评分与决策阈值评估框架
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:evaluation-framework。 它的用途是:加权评分与决策阈值评估框架 完整的 Skill 内容见:https://321skill.com/skills/evaluation-framework/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我用 evaluation-framework 评估项目风险,维度包括技术风险(权重0.4)、市场风险(0.3)、团队风险(0.3),评分标准1-5分,总分≥4分标记为高风险。' 它会自动生成评估表格,对每个维度打分并加权计算总分,最后根据阈值给出风险等级结论。
介绍
在项目评审、竞品分析或供应商评估等场景中,常常需要综合多个维度进行量化打分,并基于预设标准做出决策。evaluation-framework 提供了一套可配置的加权评分、评分标准(rubrics)和决策阈值模式,帮助用户将主观判断转化为客观、可复用的评估流程,减少人为偏差,提升决策一致性。
使用该框架时,用户只需定义评估维度、各维度权重、评分等级描述(如 1-5 分对应不同表现)以及决策阈值(如总分≥4 分视为高风险或通过),即可快速生成评估结果。框架支持灵活的评分规则组合,并内置了常见的决策逻辑(如阈值触发、加权总分排名等),适用于单次评估或批量对比。
该框架特别适合项目经理、产品经理和数据分析师等需要频繁进行多维度评估的角色。例如,项目经理可用来评估项目风险,产品经理可对比竞品功能,数据分析师可对供应商进行评分排序。它也是团队统一评估标准、沉淀决策经验的理想工具。
建议在使用前明确评估目标与维度,避免权重设置过于主观。对于非结构化或高度依赖情感判断的评估(如创意文案质量),建议结合人工评审。此外,定期回顾和调整评分标准与阈值,可保持框架的长期有效性。
核心特点
与简单的打分或排名工具不同,evaluation-framework 内置了完整的评分标准模板(rubrics)和可配置的决策阈值逻辑,并支持多维度加权运算,特别适合需要精确量化、可追溯的团队级评估场景。
注意事项
不适合需要实时流式评分或动态变化的评估场景,也不适合纯粹主观或非结构化的定性评价。
常见问题
如何自定义评分维度与权重?
通过配置文件或API传入维度名称、权重值和评分等级描述即可,支持热更新。
是否支持多级决策阈值?
支持,可设置多个阈值(如通过、警告、拒绝),并自定义触发条件。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/evaluation-framework/raw/index.md 读取 evaluation-framework 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/evaluation-framework/raw/index.md(查看排版版本)