unbrowser

不启动浏览器,低成本快速网页探索与数据提取

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:unbrowser。
它的用途是:不启动浏览器,低成本快速网页探索与数据提取
完整的 Skill 内容见:https://321skill.com/skills/unbrowser-x-5/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'使用 unbrowser 扫描目标网站 example.com,获取所有路由和 API 端点,并提取其中的表单结构为 JSON 文件。'它会自动执行命令行并返回扫描结果,识别出 5 个路由、3 个表单和 2 个 REST API 端点,同时标记出 1 个需要浏览器才能访问的页面。

介绍

unbrowser 解决的是传统网页数据采集成本高、速度慢的问题。通常开发者需要启动完整的 Chrome 或 Puppeteer 实例来抓取页面,但这种方式资源消耗大、启动慢,且容易被反爬机制识别。unbrowser 提供了一种“第一遍”快速扫描方案:无需启动完整浏览器,即可获取服务端渲染(SSR)页面内容、执行有限范围的 JavaScript、发现隐藏的路由、表单和 API 端点,并提取结构化数据,同时还能检测出哪些页面需要真正的浏览器环境才能正常访问。

使用非常简单:通过命令行直接传入目标 URL,unbrowser 会自动完成页面抓取、JS 解析、路由发现和数据提取等步骤,结果以 JSON 格式输出。你还可以通过参数控制 JS 执行范围、设置超时、选择提取的数据类型等,灵活适应不同场景。整个过程通常只需几秒钟,比启动完整浏览器快一个数量级。

适合后端开发、数据采集工程师、安全研究人员、SEO 分析师以及需要批量获取网页结构化数据的智能体开发者。尤其适合在项目初期快速了解目标网站的结构、接口数量和潜在入口点,为后续的深度分析或自动化爬虫提供蓝图。

建议将 unbrowser 作为“第一遍”扫描工具,与完整浏览器方案(如 Puppeteer、Playwright)配合使用。对于需要复杂交互、单页应用(SPA)渲染或需要绕过高级反爬机制的页面,仍应使用完整浏览器。另外注意,执行 JS 的能力有限,不适合验证码处理或动态加载大量异步内容的场景。

核心特点

与 Puppeteer、Selenium 等完整浏览器方案相比,unbrowser 无需启动图形界面或完整浏览器进程,资源消耗极低,启动速度极快,同时仍能处理有限 JS 渲染和发现路由、API 端点,适合批量的快速初次扫描。

注意事项

不适合需要完整浏览器渲染的复杂单页应用、大量异步动态加载内容或需要绕过高级反爬(如 JS 挑战、指纹检测)的场景。

常见问题

unbrowser 能抓取单页应用(SPA)吗?

可以处理部分 SSR 基础内容,但无法完整渲染客户端路由和异步组件,建议配合其他工具使用。

如何安装 unbrowser?

使用 npm install -g unbrowser 或 cargo install unbrowser,具体请参考仓库 README。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/unbrowser-x-5/raw/index.md 读取 unbrowser 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。