pi-llama-switch

为单模型切换不同配置重启 llama-server

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:pi-llama-switch。
它的用途是:为单模型切换不同配置重启 llama-server
完整的 Skill 内容见:https://321skill.com/skills/pi-llama-switch/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

‘帮我把 llama-server 切换到 vision 配置,上下文设为 4096。’,它会自动应用预定义的视觉模型参数并重启服务,使模型准备好处理图像输入。或者

对AI说:‘切换到代码生成用的低温度采样配置。’,它会快速调整采样参数并重启,让模型输出更确定性的代码。

介绍

该 Skill 解决了在单模型部署环境中,需要根据不同任务(如长上下文推理、视觉多模态处理或特定采样需求)动态调整 llama-server 运行配置的问题。当用户需要切换模型上下文长度、启用视觉投影器或调整采样参数时,无需手动停止、修改配置并重启服务,使用此 Skill 可一键完成配置切换与服务器重启。

它主要服务于使用本地 Llama 系列模型进行开发或测试的研究者、开发者,尤其是在资源有限、仅部署单一模型实例,却需要该模型以多种配置模式运行的场景。例如,白天需要标准配置进行代码生成,晚上则需要启用视觉功能处理图像描述任务。

对于频繁在文本生成、代码补全和视觉问答等不同模式间切换的用户,此 Skill 能显著提升工作效率,避免繁琐的手动操作和可能的配置错误。

使用建议是,在切换配置前确保目标模型文件已就位,并了解不同配置参数(如 --ctx-size, --vision-projector)对模型性能与资源占用的影响。注意事项包括:该 Skill 执行的是重启操作,会中断当前正在进行的推理任务;且它管理的是同一个物理模型文件的不同运行配置,并非安装或切换不同的模型文件本身。

核心特点

专注于管理单一模型文件的多套运行时配置(如上下文大小、视觉投影器、采样参数)的快速切换与重启,而非安装或切换不同的模型实体。与单纯启动或停止服务的工具相比,它更贴合需要同一模型适应不同任务参数配置的精细化操作场景。

注意事项

不适合需要同时运行多个不同模型或多模型负载均衡的场景。

常见问题

pi-llama-switch 能安装新模型吗?

不能,它只用于切换已存在模型的运行配置并重启服务。

切换配置会丢失之前的对话历史吗?

会,重启服务器通常会清空当前会话状态。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/pi-llama-switch/raw/index.md 读取 pi-llama-switch 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。