deepcloak
突破反爬虫墙的深度研究智能体,读取被拦截的网页内容。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:deepcloak。 它的用途是:突破反爬虫墙的深度研究智能体,读取被拦截的网页内容。 完整的 Skill 内容见:https://321skill.com/skills/deepcloak/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“请帮我研究一下2024年最新的前端框架趋势,并生成一份报告。”,DeepCloak会驱动研究智能体去搜索相关网页。如果遇到被Cloudflare保护的博客或技术文档,它会自动启用隐身浏览器绕过验证,抓取到完整内容,最终生成一份包含所有关键来源的引用报告,并附注说明哪些页面是通过绕过验证获取的。
介绍
DeepCloak 解决了AI研究智能体在获取网络信息时,因遇到Cloudflare、Datadome、Turnstile、reCAPTCHA等反机器人验证墙(Bot Wall)而无法访问关键网页内容的问题。当普通网络请求被拦截时,它会自动升级为“隐身抓取”模式,绕过这些防护墙,确保研究报告中包含被其他工具静默丢弃的宝贵信息,并在报告末尾提供详细的“证据记录”,说明绕过了哪些墙。
使用上,DeepCloak 提供了多种集成方式:可以作为命令行工具(CLI)直接运行,可以作为MCP服务器供Claude Desktop等AI助手调用,也可以作为Claude的技能使用。其核心是一个本地优先的编排器,整合了local-deep-research(研究循环)和CloakBrowser(隐身浏览器)两个项目,无需依赖外部API密钥。
它非常适合需要从互联网进行深度研究、撰写报告或收集信息的各类专业人士,尤其是当目标网站部署了严格的反爬虫措施时。例如,学术研究者、内容创作者、数据分析师、市场调研人员等,他们需要确保信息源的完整性和准确性,避免因内容被拦截而导致报告片面或结论错误。
使用建议:由于涉及绕过网站防护措施,请务必遵守目标网站的Robots协议和服务条款,仅将其用于合法的研究和信息收集目的。注意,其隐身抓取模式可能比普通抓取更耗费资源,建议仅在遇到验证墙时使用。
核心特点
当遇到反爬虫墙时,同类工具通常静默丢弃该页面,导致报告内容缺失且用户无从知晓;而DeepCloak能自动切换至隐身模式绕过验证,并明确告知用户哪些来源曾被拦截,实现了能力与透明度的结合。
注意事项
不适合用于违反网站服务条款或法律法规的爬取活动,且隐身抓取模式速度可能较慢。
常见问题
DeepCloak 合法吗?
DeepCloak 是一个工具,其合法性取决于使用目的和方式。用户应遵守目标网站的Robots协议和服务条款,仅用于合法授权的研究和信息收集。
需要API密钥吗?
不需要。DeepCloak 是本地优先的工具,不依赖外部API,但需要本地运行LLM(如Qwen)和搜索引擎(如SearXNG)来驱动研究循环。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/deepcloak/raw/index.md 读取 deepcloak 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/deepcloak/raw/index.md(查看排版版本)