Sage Router

本地优先的AI模型路由工具,统一端点智能调度

安装使用

复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:

帮我安装这个 AI Skill:Sage Router。
它的用途是:本地优先的AI模型路由工具,统一端点智能调度
完整的 Skill 内容见:https://321skill.com/skills/sage-router-x-2/raw/index.md
请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。

提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。

使用示例

'使用 Sage Router 调用 gpt-4 和本地 llama3 进行对比,帮我分析这段代码的潜在漏洞,并返回两个模型的结果差异。' 它会自动将请求路由到两个模型,等待响应后生成对比分析报告,无需手动切换 API 或管理多个连接。

介绍

Sage Router 解决的是智能体开发中多模型调用的碎片化问题。当你的应用需要同时调用 OpenAI、Anthropic、本地开源模型等多个供应商的模型时,手动管理端点、鉴权、容错和负载均衡会变得非常繁琐。Sage Router 提供单一的本地端点,自动将请求路由到最合适的模型,并根据响应质量、延迟、成本等指标动态调整,让你无需关心底层细节。

使用方式非常简单:启动 Sage Router 本地服务后,只需将你的 AI 调用地址指向本地端口(例如 http://localhost:8090),然后像往常一样发送请求即可。路由器会自动识别你的请求类型(如文本生成、代码补全、分析等),并从已配置的模型列表中选择最优模型执行,同时缓存结果以降低重复调用成本。

适合智能体开发者、后端工程师和全栈工程师,特别是那些需要同时集成多个 AI 供应商、或者希望快速切换测试不同模型效果的团队。也适合对成本敏感、希望在本地运行小模型但又能随时切换到云端大模型的场景。

注意事项:Sage Router 是本地优先工具,首次使用时需要配置至少一个模型供应商(API Key 或本地模型路径)。由于它自动路由,对于需要精确控制每个请求必须使用特定模型的情况(如合规审计、强制使用某供应商),建议手动指定路由规则。另外,路由器本身不存储用户数据,所有请求均通过本地转发,隐私保护较好。

核心特点

与同类工具(如 LiteLLM、OpenRouter)相比,Sage Router 主打本地优先设计,无需依赖外部服务即可运行,同时支持自定义路由策略(如按成本、延迟、质量加权),并内置智能体场景下的上下文缓存和错误重试机制。

注意事项

不适合需要绝对控制每个请求必须使用特定模型且不允许自动路由的严格合规场景。

常见问题

Sage Router 支持哪些模型供应商?

理论上支持所有 OpenAI 兼容 API 的供应商(包括 OpenAI、Anthropic、Google、本地 Ollama 等),你也可以通过配置文件添加自定义端点。

如何配置路由规则?

在配置文件中设置模型优先级、成本阈值、延迟阈值等,路由器会根据这些参数自动选择最优模型。也可以编写简单的 JavaScript 规则函数实现自定义逻辑。

给 AI 助手的安装指引

如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:

请访问 https://321skill.com/skills/sage-router-x-2/raw/index.md 读取 Sage Router 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。