Ceph Aiops
通过REST API诊断Ceph集群健康状态,解析告警原因
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Ceph Aiops。 它的用途是:通过REST API诊断Ceph集群健康状态,解析告警原因 完整的 Skill 内容见:https://321skill.com/skills/ceph-aiops-x-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'我的Ceph集群出现HEALTH_WARN,帮我诊断一下原因。' 它会自动连接Ceph Dashboard API,获取集群健康状态,解析出比如'OSD down'或'PG inconsistent'等具体原因,并给出修复建议,如'重启OSD 3'或'执行ceph pg repair 2.1'。
介绍
Ceph集群出现HEALTH_WARN或HEALTH_ERR时,运维人员需要快速定位根因并修复。该Skill通过调用ceph-mgr Dashboard REST API,自动获取集群健康状态,将告警码解码为可读的故障原因和修复建议,省去手动查阅文档或登录多台节点的步骤。
使用方式非常简单:你只需提供Ceph Dashboard的地址、端口和API密钥(或用户凭证),然后以自然语言描述告警现象,例如“我的Ceph集群报警了,帮我查一下原因”,Skill即可自动发起API请求,解析返回的健康状态数据,输出结构化的问题清单和修复步骤。
适合Ceph运维工程师、系统管理员以及需要管理Ceph集群的后端开发人员。无论是日常巡检、故障响应还是容量规划,都可以借助此Skill快速掌握集群健康全貌。
建议在测试环境先验证API连通性,并注意API密钥的权限范围,避免赋予过高权限。同时,由于诊断需要频繁调用Dashboard接口,请勿在生产环境高并发使用,以免影响集群性能。
核心特点
与同类Ceph诊断工具相比,本Skill直接集成在AI Agent中,无需手动拼装curl命令或翻阅日志文件,通过自然语言交互即可获取诊断结果,并自动关联历史告警上下文。
注意事项
依赖ceph-mgr Dashboard REST API的可用性和版本,不适用于未启用Dashboard或API版本不兼容的Ceph集群。
常见问题
如何获取Ceph Dashboard API密钥?
通过ceph dashboard ac-user-create命令创建用户,并获取生成的密钥。
支持Ceph哪个版本?
支持Ceph Luminous 12.2.x及以上版本(需开启Dashboard模块)。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/ceph-aiops-x-5/raw/index.md 读取 Ceph Aiops 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/ceph-aiops-x-5/raw/index.md(查看排版版本)