Web Collection
云端优先的网页采集与排障工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Web Collection。 它的用途是:云端优先的网页采集与排障工具 完整的 Skill 内容见:https://321skill.com/skills/web-collection-x-6/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请帮我抓取https://example.com/article的所有正文内容,并保存为Markdown文件',它会自动连接云端服务,提取网页内容并返回格式化文件。或者简单说'抓取网页内容',它会引导你输入目标网址,完成采集。
介绍
解决网页内容采集、上手与排障的痛点,提供云端优先的解决方案,无需本地环境复杂配置,即可快速采集网页数据并处理常见问题。
通过简单的命令或配置,连接云端服务,指定目标网页,即可自动采集内容,并支持排障功能,如检查采集失败原因、调整参数等。
适合数据分析师、内容创作者、电商运营等需要频繁采集网页数据、进行竞品分析、市场调研的用户。
使用建议:注意遵守网站robots协议和法律法规,合理设置采集频率,避免对目标网站造成压力。同时,云端存储注意数据安全。
核心特点
与同类网页采集工具相比,Web Collection强调云端优先,无需本地安装复杂环境,提供开箱即用的采集与排障能力,特别适合快速上手和远程协作。
注意事项
不适合需要高度定制化、离线操作或对隐私要求极高的场景。
常见问题
如何安装Web Collection?
执行 npm install -g web-collection 即可全局安装,或使用 git clone 拉取仓库后运行。具体安装命令见下方。
支持哪些网站抓取?
支持大多数公开网页,但需遵守目标网站的robots协议和法律法规,部分反爬严格的网站可能受限。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/web-collection-x-6/raw/index.md 读取 Web Collection 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/web-collection-x-6/raw/index.md(查看排版版本)