Sage Router
本地优先的AI模型路由工具
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:Sage Router。 它的用途是:本地优先的AI模型路由工具 完整的 Skill 内容见:https://321skill.com/skills/sage-router-x-5/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我配置一个路由规则,将代码生成任务优先路由到 Claude,将简单问答路由到 GPT-4o-mini,并设置每月 Token 预算上限 100 万。' Sage Router 会生成对应的配置文件,并在后续请求中自动按规则路由,同时监控 Token 消耗,超出预算时自动降级到免费模型。
介绍
Sage Router 解决的是 AI 代理在调用多个模型时的路由问题。当你的智能体需要同时使用不同提供商(如 OpenAI、Anthropic、本地模型)时,管理多个 API 端点、切换模型、控制成本变得复杂。Sage Router 提供一个统一的端点,自动根据任务类型、成本、延迟等因素将请求路由到最合适的模型,无需手动配置每次调用。
使用非常简单:你只需向 Sage Router 发送请求,它会根据预设规则(如模型性能、Token 成本、响应速度)自动选择提供商。支持接入任意兼容 OpenAI 格式的 API,包括本地部署的 LLM。你可以通过配置文件或代码定义路由策略,例如“代码生成优先用 Claude,简单问答用 GPT-4o-mini”。
适合智能体开发者、全栈工程师、后端开发者以及需要频繁切换多个 AI 模型的研究人员。尤其适合构建生产级 AI 应用,需要平衡成本、性能与可靠性的团队。也适合个人开发者管理本地模型与云模型,实现“本地优先,云端补充”的灵活架构。
建议先在小范围测试路由策略,观察 Token 消耗和响应质量。注意路由规则可能影响结果一致性,关键任务建议设置回退模型。定期检查各提供商 API 状态,避免因单一服务不可用导致整体中断。
核心特点
Sage Router 是本地优先的,所有路由决策在本地执行,无需依赖第三方云服务,同时支持任意 OpenAI 兼容 API,无需额外适配。
注意事项
不适合需要完全手动控制每个请求具体模型参数的场景,也不支持非 OpenAI 协议的自定义 API。
常见问题
如何添加新的模型提供商?
在配置文件中添加兼容 OpenAI API 的 base_url 和 api_key,指定模型名称即可。
是否支持本地部署的模型?
支持,只要本地模型提供 OpenAI 兼容的 API 接口(如 Ollama、vLLM 等)即可接入。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/sage-router-x-5/raw/index.md 读取 Sage Router 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/sage-router-x-5/raw/index.md(查看排版版本)