grok-media-skill

为 Codex 提供基于 Grok 的图像与视频生成编辑能力

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:grok-media-skill。
它的用途是:为 Codex 提供基于 Grok 的图像与视频生成编辑能力
详细介绍见:https://321skill.com/skills/grok-media-skill-happy-loki/
请根据该页面的说明完成安装。

使用示例

“我想做一个关于夏日旅行的短视频。” Skill 会引导你确认视频主题、风格、时长等细节,最终生成一段符合你想象的视频。或者

对AI说:“帮我把这张人物照片的背景改成雪山。” 它会询问你对画质、分辨率等的要求,然后输出编辑后的图片。

介绍

这是一个专为 Codex 设计的 AI Agent Skill,它通过集成 Grok 的媒体生成模型,让用户能够在 Codex 的对话环境中直接创作和编辑图像与视频。用户只需配置好 Sub2API 的 base_urlAPI Key,即可解锁强大的视觉内容生成能力。

Skill 的使用流程设计得非常人性化。在首次使用时,它会自动检查 Python 环境和网络连接,确保基础条件完备。在创作过程中,它会通过多轮对话引导用户逐步明确创作目标,从用途、视觉风格到输出规格,最终形成一份清晰的创作简报,用户确认后才会提交生成请求,避免盲目消耗。

该 Skill 非常适合需要在工作流中快速生成视觉素材的创作者、营销人员和内容运营者。无论是为文章配图、制作宣传短片,还是进行简单的视频编辑和续写,它都能在 Codex 的聊天界面中一站式完成,无需切换工具。

使用前请确保已准备好可用的 Sub2API 服务与密钥。Skill 会自动利用系统代理环境变量,并优化请求头以减少被拦截的风险。对于视频连续续写等高级功能,需要本地安装 FFmpeg 等依赖,Skill 会提供明确的安装指引。

核心特点

与同类 Skill 相比,它深度集成于 Codex 对话流,通过智能的多轮问答收窄创作需求,避免用户一次性提供所有复杂参数;同时,它统一处理代理和网络问题,并对所有请求进行严格的前置校验,确保只提交符合 Grok API 规范的有效请求,减少因格式错误导致的失败和计费浪费。

注意事项

不适合需要即时、单次指令快速生成图片的轻量级场景,所有请求都必须经过多轮对话确认。

常见问题

如何配置代理?

Skill 会自动读取 GROK_MEDIA_PROXY、标准 HTTP(S)_PROXY 环境变量及系统代理设置,无需在 config.json 中额外配置。

视频生成是同步的吗?

不是。视频生成、编辑和续写都是异步任务,提交后会返回 request_id,Skill 会自动轮询状态直至完成。