百度文档解析pipeline-parser

调用百度API解析文档,支持多格式提取文本表格与OCR。

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:百度文档解析pipeline-parser。
它的用途是:调用百度API解析文档,支持多格式提取文本表格与OCR。
完整的 Skill 内容见:https://321skill.com/skills/百度文档解析pipeline-parser-x-6/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“帮我解析这个PDF扫描件,提取所有文本和表格,标注版面结构,并按段落分块。” 它会调用百度文档解析API,识别出文档中的文字、表格位置、图片说明,返回JSON格式的结构化数据,同时自动进行RAG分块,方便后续存入知识库或用于检索增强生成。

介绍

本技能解决从各种文档中高效提取结构化信息的难题。无论是PDF、Word、Excel、PPT还是扫描件,你无需在不同工具间切换,只需一个指令即可完成文本提取、表格识别、版面分析和OCR识别,并自动进行RAG文档分块,为后续检索或知识库构建提供干净的数据。

使用非常简单:直接告诉AI要解析的文档路径或链接,并指定需要提取的内容类型(如文本、表格、版面结构)。技能会调用百度文档解析API,自动识别格式、执行OCR(针对扫描件)、分析版面布局,最终返回结构化结果,支持按需分块。

适合需要批量处理文档的数据分析师、需要整理资料的研究者、需要从PDF/扫描件中提取关键信息的文档工程师,以及任何需要将非结构化文档转化为可检索数据的用户。

建议提前准备好百度API Key并确保网络通畅。对于超大文档(超过100页)或复杂布局的表格,建议先测试小样本以确认效果。注意本技能依赖外部API,无法离线使用。

核心特点

相比通用文档解析工具,本技能直接对接百度成熟的文档解析API,支持18+格式且内置OCR和RAG分块,无需额外配置模型;同类技能通常只支持单一格式或本地解析,缺少对扫描件和版面分析的原生支持。

注意事项

需要联网调用百度API,且对超大文档(超过100页)或极低质量扫描件可能效果有限。

常见问题

支持哪些文档格式?

支持PDF、Word、Excel、PPT、图片等18+常见格式,包括扫描件和图片中的文字识别。

使用前需要准备什么?

需要拥有百度云API Key并配置好环境,首次使用需安装依赖包(如pip install pipeline-parser)。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/百度文档解析pipeline-parser-x-6/raw/index.md 读取 百度文档解析pipeline-parser 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。