百度文档解析pipeline-parser

百度文档解析API封装,支持18+格式提取文本表格

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:百度文档解析pipeline-parser。
它的用途是:百度文档解析API封装,支持18+格式提取文本表格
完整的 Skill 内容见:https://321skill.com/skills/百度文档解析pipeline-parser-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'请解析这份PDF合同,提取所有文本和表格内容',它会调用百度文档解析API,返回结构化数据,包括文本段落、表格数据以及版面信息。

介绍

该Skill解决了文档解析的痛点:当你需要从PDF、Word、Excel、PPT或图片中提取文本、表格、版面信息或进行OCR识别时,手动复制粘贴效率低、格式混乱。它通过调用百度文档解析API,自动将多种格式文档转化为结构化数据,支持RAG文档分块,为后续知识库构建或文本分析提供干净输入。

使用方式简单:在AI对话中直接上传文档或提供文档链接,通过自然语言指令(如“解析这份PDF,提取所有表格”)即可触发。Skill自动处理文档格式识别、API调用、结果整理,返回包括文本段落、表格数据、版面坐标、OCR识别结果在内的完整输出。

适合需要频繁处理文档的学术研究者、数据分析师、高校学生,以及任何需要从文档中快速提取结构化信息的内容工作者。特别适合用于构建RAG知识库前的文档预处理,或批量分析合同、报告、论文等场景。

使用建议:确保网络畅通,因为依赖百度在线API。注意免费额度限制,高频大量使用需申请付费密钥。对于扫描件质量较差或手写体,OCR准确率可能下降,建议配合清晰原图。

核心特点

相比其他文档解析工具,该Skill直接集成百度官方文档解析API,支持18+格式且内置RAG文档分块功能,无需额外配置即可输出适合向量检索的文本块。

注意事项

需联网调用百度API,有免费额度限制,不适合离线或高隐私要求的文档处理场景。

常见问题

支持哪些文件格式?

支持PDF、Word(doc/docx)、Excel(xls/xlsx)、PPT(ppt/pptx)、图片(jpg/png等)等18+常见格式。

有免费额度吗?如何获取API密钥?

百度文档解析API有免费调用额度,需在百度AI开放平台申请API Key和Secret Key,配置到Skill中。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/百度文档解析pipeline-parser-x-2/raw/index.md 读取 百度文档解析pipeline-parser 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。