@adamjen/pi-compact-fast
用快速本地模型压缩Pi会话,节省Token
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:@adamjen/pi-compact-fast。 它的用途是:用快速本地模型压缩Pi会话,节省Token 完整的 Skill 内容见:https://321skill.com/skills/adamjen-pi-compact-fast/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'使用/compact-fast命令压缩当前会话',它会调用配置的快速本地模型(如qwen-35b-moe)生成会话摘要,并返回给Pi内置的压缩系统,从而节省主模型Token消耗并加快压缩速度。整个过程无需切换模型,只需一条命令即可完成。
介绍
这个Skill解决了Pi用户在使用昂贵主模型进行会话压缩时Token消耗过高、速度过慢的问题。在实际开发中,开发者经常需要频繁压缩长对话来释放上下文窗口,但主模型(如GPT-4)的压缩成本高昂,且压缩速度受限于模型推理效率。
使用方式很简单,你只需要在Pi中输入/compact-fast命令即可。它会自动查找配置中的qwen-35b-moe模型(或其他自定义模型),通过独立API调用生成会话摘要,并将结构化摘要返回给Pi内置的压缩系统。你还可以通过修改extensions/index.ts中的COMPACT_MODEL_ID来切换使用的模型。
它非常适合需要频繁管理长对话的Pi用户,尤其是使用高成本模型(如GPT-4、Claude 3 Opus)的开发者。那些在编码过程中积累了大量上下文、需要定期压缩以保持会话连贯性的智能体开发者和后端开发者,将从中获得显著的Token节省和效率提升。
建议在配置好models.json中指定快速模型(如qwen-35b-moe)后统一使用此工具。需要注意的是,它依赖Pi平台和@mariozechner/pi-ai库,且压缩模型必须已在本地或远程配置中可用。如果快速模型响应失败,命令会优雅退出,不会影响当前会话。
常见问题
如何更改压缩使用的模型?
编辑`extensions/index.ts`中的`COMPACT_MODEL_ID`变量,将其设为你的模型ID(需在`models.json`中定义)。
压缩会话会丢失对话内容吗?
不会。Pi的压缩系统会保留摘要、第一条保留消息ID、Token数等结构化信息,完整对话历史仍可回溯。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/adamjen-pi-compact-fast/raw/index.md 读取 @adamjen/pi-compact-fast 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/adamjen-pi-compact-fast/raw/index.md(查看排版版本)