pi-llamacpp-provider

将本地 llama.cpp 服务器注册为 AI 模型提供方

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:pi-llamacpp-provider。
它的用途是:将本地 llama.cpp 服务器注册为 AI 模型提供方
完整的 Skill 内容见:https://321skill.com/skills/pi-llamacpp-provider/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

“请使用我本地服务器上的 Llama3 模型来总结这篇文档。” 它会通过此 Skill 调用你本地 llama.cpp 服务器上的指定模型进行处理并返回结果。或者,在 PI 的模型选择列表中,你会直接看到本地服务器提供的所有模型选项,点击即可切换使用。

介绍

这个 Skill 解决的核心问题是,如何让你在本地部署的 llama.cpp 服务器及其模型,能够无缝接入到 PI 等 AI 平台中使用,无需手动配置每个模型。它通过自动发现服务器暴露的模型接口,将模型信息注册为提供方,从而扩展了 AI 平台的后端能力。

使用方式非常简单:在安装此 Skill 后,它会自动查询你指定的 llama.cpp 服务器的 /v1/models 端点,获取服务器上所有可用的模型列表及其详细能力(如上下文长度、是否支持视觉或思维链),并将这些模型注册为 PI 平台的一个提供方。之后,你就可以在 PI 中直接选择并使用这些本地模型了。

它非常适合那些已经在本地运行 llama.cpp 服务器,拥有多个定制或高性能开源模型(如 Llama、Qwen、Phi 等系列),并希望将这些模型集成到更友好、功能更丰富的 AI 客户端(如 PI)中进行对话或任务处理的开发者和高级用户。

使用建议:确保你的 llama.cpp 服务器版本较新,并正确启用了 API 服务(通常通过 --server 等参数)。注意事项:该 Skill 主要负责“桥接”和“发现”,模型本身的质量、性能及硬件需求取决于你的本地部署。网络稳定性会影响模型发现的成功率。

核心特点

核心区别在于“自动发现”:它无需手动逐个配置模型,而是通过调用 llama.cpp 服务器的标准 API 端点,自动获取并注册所有可用模型及其完整能力参数(包括上下文大小、视觉和思维支持),实现了与本地模型仓库的动态同步。

注意事项

不适合没有本地部署 llama.cpp 服务器或无法稳定访问该服务器 API 端点的用户。

常见问题

需要先安装和运行 llama.cpp 服务器吗?

是的,你需要先本地部署并运行一个开启了 API 服务的 llama.cpp 服务器。

它能自动发现新下载的模型吗?

可以,只要模型被 llama.cpp 服务器加载并通过 /v1/models 端点暴露,Skill 就能发现它。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/pi-llamacpp-provider/raw/index.md 读取 pi-llamacpp-provider 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。