Kubernetes
Kubernetes集群故障排查与YAML清单审查专家
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Kubernetes。 它的用途是:Kubernetes集群故障排查与YAML清单审查专家 完整的 Skill 内容见:https://321skill.com/skills/kubernetes-x/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
‘我的一个Pod状态是CrashLoopBackOff,命名空间是production,Pod名称是app-frontend-xxxx,能帮我分析一下可能的原因吗?’ 它会引导您查看Pod描述、日志和事件,帮助定位是应用启动错误、依赖缺失、权限问题还是资源不足导致的崩溃。或者,
对AI说:‘请帮我审查下面这个Deployment的YAML,看看资源配置和探针设置有没有问题。’ 它会逐项分析请求与限制、存活/就绪探针的配置,并给出优化建议。
介绍
这是一个专注于Kubernetes集群运维与开发的AI技能。它能帮助用户诊断和解决Kubernetes工作负载的各种疑难杂症,例如Pod处于Pending、CrashLoopBackOff、ImagePullBackOff、OOMKilled或卡在Terminating状态,Service或Ingress返回502/503/504错误,集群DNS不稳定,滚动更新挂起或静默部署了损坏版本,HPA拒绝扩缩容,PVC处于未绑定状态,节点变为NotReady或排空操作无法完成等问题。
当您遇到上述任何问题时,只需向AI描述故障现象或提供相关的YAML片段,它便能引导您进行系统性的排查,分析日志、事件和资源状态,定位根本原因并提供修复建议。它还能审查YAML清单、Helm Chart或Kustomize覆盖文件,帮助您优化资源配置、探针设置、优雅关闭和安全策略。
该技能非常适合需要与Kubernetes集群打交道的运维工程师、DevOps工程师、后端开发者和平台工程师。无论是日常运维、故障应急响应,还是编写和审查部署清单,它都能提供专业的指导。
使用建议:在提问时,尽可能提供具体的错误信息、Pod名称、命名空间或相关的YAML配置,这有助于AI给出更精准的分析。请注意,此技能专注于Kubernetes集群层面的管理和调试,不涉及Docker镜像构建等容器构建环节。
核心特点
与通用Kubernetes助手相比,它深度聚焦于生产环境中高频出现的具体故障场景(如Pod各种异常状态、网络问题、存储问题、节点问题),并提供从现象到根因的排查路径和修复方案,而非泛泛的概念解释。
注意事项
不适用于构建Docker容器镜像,那是`docker`技能的范畴。
常见问题
Pod一直处于Pending状态怎么办?
我会引导您检查节点资源(CPU/内存)是否充足、节点选择器/污点容忍度是否匹配、持久卷声明(PVC)是否绑定成功,以及是否有资源配额限制。
如何审查Deployment的YAML配置是否合理?
我会帮您分析资源配置请求与限制、存活/就绪探针设置、滚动更新策略、镜像拉取策略、安全上下文等,并提供优化建议。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/kubernetes-x/raw/index.md 读取 Kubernetes 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/kubernetes-x/raw/index.md(查看排版版本)