Byted EMR Skills

管理火山引擎EMR集群与作业的AI技能

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Byted EMR Skills。
它的用途是:管理火山引擎EMR集群与作业的AI技能
完整的 Skill 内容见:https://321skill.com/skills/byted-emr-skills-x/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'创建一个EMR on VKE集群,3个core节点,Hadoop 3.2和Spark 3.3,并提交一个PySpark作业计算日均PV。' 它会自动创建集群、提交作业,并返回作业ID和进度。之后再问'诊断一下刚才的作业为什么失败',它会分析日志并指出'内存溢出,建议增加executor内存'。

介绍

火山引擎EMR(E-MapReduce)是开源Hadoop生态的企业级大数据分析系统,完全兼容开源。本技能旨在帮助用户高效管理EMR on ECS集群、EMR on VKE集群、EMR Serverless队列与计算组,以及SparkSQL、PrestoSQL、Ray、PySpark、SparkJar等各类作业的提交与监控,并提供智能诊断与知识问答能力。

使用方式:通过自然语言描述需求,技能自动调用火山引擎API或执行内部逻辑,完成集群创建/扩缩容、作业提交/终止、日志分析、诊断报告生成等操作。例如,对AI说“创建一个EMR on VKE集群,3个节点,Spark 3.3”,它会自动配置并返回连接信息。

本技能适合运维工程师、数据分析师、后端开发等需要频繁管理大数据集群和作业的人员,尤其是使用火山引擎EMR的用户。它可以大幅减少在控制台的手动操作,提升集群管理和故障排查效率。

使用建议:确保已正确配置火山引擎访问密钥(AK/SK)和权限;对于生产环境,建议先在小规模集群测试;智能诊断依赖日志分析,请确保作业日志已开启并持久化。

核心特点

与通用EMR管理工具不同,本技能深度绑定火山引擎EMR的具体API和操作逻辑,并集成了智能诊断和知识问答能力,能直接分析作业失败根因并提供修复建议,无需额外对接第三方日志平台。

注意事项

不适用于非火山引擎EMR平台(如阿里云EMR、自建Hadoop集群),也不支持Structured Streaming等实时流式作业的完整管理。

常见问题

如何创建EMR on ECS集群?

直接说“创建一个EMR on ECS集群,指定节点数和软件版本”,技能会自动调用API创建并返回集群ID和连接信息。

如何诊断Spark作业失败原因?

说“诊断一下昨天Spark作业失败的原因”,技能会查看作业日志,分析常见错误(如OOM、资源不足、代码异常)并给出修复建议。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/byted-emr-skills-x/raw/index.md 读取 Byted EMR Skills 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。