Ceph Aiops
通过REST API操作和诊断Ceph集群,解析健康状态告警。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Ceph Aiops。 它的用途是:通过REST API操作和诊断Ceph集群,解析健康状态告警。 完整的 Skill 内容见:https://321skill.com/skills/ceph-aiops/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'我的Ceph集群状态显示为HEALTH_WARN,提示“too many PGs per OSD”,请分析一下原因并给出调整建议。',它会通过查询集群的PG分布和OSD负载数据,解释该警告的含义,计算当前配置,并建议如何调整pool的pg_num和pgp_num参数以优化分布。
介绍
当用户需要操作或诊断Ceph集群时,此技能通过调用ceph-mgr Dashboard的REST API,将集群的HEALTH_WARN或HEALTH_ERR状态解码为具体的原因和解决方案。它充当了用户与Ceph集群管理接口之间的智能桥梁,简化了复杂的运维操作。
使用此技能时,用户只需提出与Ceph集群状态、性能或配置相关的问题或指令,AI便会解析需求,构造相应的API请求,获取集群数据,并以易于理解的方式呈现诊断结果或执行操作。
该技能非常适合负责Ceph存储集群日常维护和故障排查的运维工程师、运维开发人员,以及需要了解集群状态以支持应用开发的后端开发人员。
使用前需确保AI具有访问Ceph Dashboard API的权限和必要的认证信息(如API密钥)。由于涉及集群关键操作,建议在非生产环境或充分了解命令后果后使用,并注意API的版本兼容性。
核心特点
专注于Ceph存储集群的REST API交互与健康状态智能解码,能将晦涩的集群警告直接转化为可操作的运维建议,而不仅仅是提供通用的API调用能力。
注意事项
不适合用于管理非Ceph存储系统,或在不具备API访问权限和认证信息的情况下使用。
常见问题
这个技能能帮我重启Ceph集群吗?
不能直接重启集群,但可以通过API查询服务状态、监控节点,并指导您安全地进行相关维护操作。
需要我提供什么信息才能使用?
通常需要Ceph Dashboard的API端点地址、端口以及有效的认证令牌(如用户名密码或Bearer Token)。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/ceph-aiops/raw/index.md 读取 Ceph Aiops 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/ceph-aiops/raw/index.md(查看排版版本)