百度文档解析pipeline-parser
调用百度API实现多格式文档解析与提取
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:百度文档解析pipeline-parser。 它的用途是:调用百度API实现多格式文档解析与提取 完整的 Skill 内容见:https://321skill.com/skills/百度文档解析pipeline-parser-x-4/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'请解析这份PDF合同,提取所有文本和表格,并以Markdown格式输出。' AI会调用百度文档解析API,返回合同文本和表格数据。或者
对AI说:'把这张扫描版发票图片OCR识别成可编辑文本,并提取金额和日期。' 它会自动完成扫描识别与结构化提取。
介绍
【解决什么问题】当您需要从PDF、Word、Excel、PPT、图片等18+种格式的文档中快速提取文本、表格、识别扫描件或进行版面分析时,这个Skill可以帮您直接调用百度文档解析API完成处理,无需手动转换或编写复杂解析代码。
【怎么用】在AI对话中直接上传文档或提供文件链接,AI会自动调用百度文档解析接口,返回结构化结果:纯文本、表格数据、OCR识别内容、版面布局信息等。也可以指定仅提取特定部分(如表格)或进行RAG文档分块,为后续知识库构建提供素材。
【适合谁】需要频繁处理文档的学术研究者(论文、文献)、数据分析师(数据报表、表格提取)、文档工程师(技术文档、规范文件)、以及需要将扫描件转为可编辑文本的办公人员。
【使用建议】确保网络畅通且百度API密钥有效(需自行配置)。对于超大文档(如数百页),解析耗时可能较长,建议分批处理。注意隐私保护,敏感文档请勿上传至公共API。
核心特点
相比通用OCR或PDF解析库,本Skill直接集成百度文档解析API,支持格式最全(18+种),且自带版面分析、表格提取和RAG分块能力,无需额外配置多个工具。
注意事项
依赖百度API服务和网络,无网络或API配额不足时无法使用;对复杂排版(如手写笔记、混合彩色背景)的OCR准确率可能低于专用本地模型。
常见问题
支持哪些文档格式?
支持PDF、Word(doc/docx)、Excel(xls/xlsx)、PPT(ppt/pptx)、图片(jpg/png/bmp/tiff等)等18+种常见格式,具体可查阅百度文档解析API文档。
需要付费吗?
百度文档解析API有免费额度,超出后按量计费。本Skill本身不额外收费,但需用户自行配置自己的API密钥并承担调用费用。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/百度文档解析pipeline-parser-x-4/raw/index.md 读取 百度文档解析pipeline-parser 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/百度文档解析pipeline-parser-x-4/raw/index.md(查看排版版本)