@okrapdf/pi
基于视觉模型解析PDF,支持布局识别与搜索截图。
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:@okrapdf/pi。 它的用途是:基于视觉模型解析PDF,支持布局识别与搜索截图。 完整的 Skill 内容见:https://321skill.com/skills/okrapdf-pi/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
“请解析我刚上传的这份市场分析PDF,并找出所有关于‘市场规模预测’的段落,把相关部分的截图给我。”,它会先理解文档的版面布局,然后定位到相关文本所在区域,最后生成清晰的截图供你使用。
介绍
该Skill旨在解决传统PDF解析工具难以处理复杂版面(如多栏、图表混排)的问题,它能智能识别文档的视觉布局,从而准确提取文本、进行语义搜索并生成指定内容的截图。
使用方式非常便捷,用户只需在Pi平台(已内置认证的视觉模型)中安装此Skill,即可通过简单的指令对上传的PDF文档进行解析、内容查询或区域截图,无需额外配置模型API。
它非常适合需要从学术论文、技术报告、商业文档等版式复杂的PDF中快速提取和定位信息的研究人员、分析师、学生以及任何有文档处理需求的职场人士。
建议在处理对格式保真度要求高的文档时优先使用此Skill。请注意,其解析效果依赖于原始PDF的清晰度和视觉模型的识别能力,对于极度模糊或纯图片式扫描文档可能效果不佳。
核心特点
直接利用Pi平台已认证的视觉模型进行解析,无需用户自行获取和管理模型API密钥;专注于“布局感知”,能更好地理解文档的视觉结构,而非简单文本提取。
注意事项
不适合处理低质量扫描件或完全由手写体、特殊符号构成的PDF文档。
常见问题
需要自己申请视觉模型的API吗?
不需要,它直接使用Pi平台内已集成的认证模型。
能提取PDF里的表格和图片吗?
主要专注于文本的布局感知解析和截图,对表格和图片内文字的识别能力取决于模型,不直接输出结构化表格数据。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/okrapdf-pi/raw/index.md 读取 @okrapdf/pi 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/okrapdf-pi/raw/index.md(查看排版版本)