ax

AI时代的curl,一站式完成网页抓取、结构探索与数据提取。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:ax。
它的用途是:AI时代的curl,一站式完成网页抓取、结构探索与数据提取。
完整的 Skill 内容见:https://321skill.com/skills/ax/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘使用ax抓取示例新闻网站首页,并提取所有新闻标题和链接。’ 它会执行类似 `ax https://news.example.com --row 'title=h2, link=a@href'` 的命令,返回结构清晰的TSV或JSON数据。或者

对AI说:‘帮我看看这个文档页面的主要结构。’ 它会使用 `ax https://docs.example.com --outline` 来生成一个简洁的页面大纲,而不是将整个HTML塞给你。

介绍

ax 旨在解决AI智能体在自动化任务中处理网页数据时的核心痛点:传统的 curl 命令结合临时解析脚本的流程繁琐、脆弱且低效。智能体需要反复执行“抓取→理解→提取”的循环,而 curl 在遇到空响应体时静默无声,原始HTML会浪费大量上下文窗口的token,且临时编写的解析脚本极易因网页结构变化而失效。

ax 通过一个统一的命令简化了整个流程。用户可以直接使用 ax <URL> 进行基础抓取,它会始终返回包含状态、URL、耗时、头部和正文的完整报告。通过 --outline 参数可以探索页面的重复结构,--locate 可以定位特定文本所在的CSS选择器,而无需将原始HTML暴露给AI。对于数据提取,--row 参数可以一次性提取多字段数据行,--table 可将HTML表格转换为结构化数据,--where 则支持使用安全的表达式语言进行过滤。

这个工具主要面向开发AI智能体、自动化脚本或需要与网页进行结构化交互的程序员和工程师。它特别适合那些希望让AI助手(如Claude、Cursor等)能够稳定、高效地获取和处理网络信息的场景,替代过去依赖 curlhtmlq 或临时Python脚本的拼凑方案。

使用建议是,对于需要快速、确定性地从静态或API页面提取结构化数据的任务,ax是理想选择。但需要注意,它主要处理服务器端渲染的HTML或JSON API,对于重度依赖JavaScript的现代单页应用(SPA),其提取能力有限,此时可能需要结合无头浏览器工具。此外,解析模式下的请求会默认启用短期缓存以提升探索效率,但带有自定义头部、非GET方法或请求体的操作会自动绕过缓存。

核心特点

与 `htmlq`(仅CSS选择器)或 `curl`(静默且无结构)不同,ax将抓取、探索和结构化提取整合进一个单一、为AI交互设计的工具。它提供页面结构概览、多字段行提取、表格转换等功能,且输出格式(如TSV/JSON)和长度(支持token预算控制)专为优化AI上下文窗口而设计。

注意事项

不适合处理严重依赖客户端JavaScript渲染的动态单页应用(SPA)。

常见问题

ax和curl有什么区别?

ax是curl的增强版,专为AI设计。它永不静默(即使空响应也报告详情),能探索页面结构,并直接提取结构化数据,而curl仅返回原始响应。

ax能替代无头浏览器吗?

不能。ax擅长处理静态HTML和API。对于需要执行JavaScript才能加载内容的动态网页,仍需使用Puppeteer、Playwright等无头浏览器工具。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/ax/raw/index.md 读取 ax 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。