free-tier-ai-router
免费API密钥智能路由,最大化AI调用额度
安装使用
复制下面这段提示词发给你的 AI(Claude / Cursor / TRAE / Codex / WorkBuddy 等),它会自动帮你完成安装:
帮我安装这个 AI Skill:free-tier-ai-router。 它的用途是:免费API密钥智能路由,最大化AI调用额度 完整的 Skill 内容见:https://321skill.com/skills/free-tier-ai-router/raw/index.md 请读取该页面内容,如果是 SKILL.md 格式直接安装,如果是 README 提炼核心 prompt 后安装。
提示词包含完整的 Skill 内容链接,AI 读取后即可完成安装。你也可以 查看完整内容 确认无误。
使用示例
'帮我配置free-tier-ai-router,使用我的Gemini和OpenRouter免费密钥,将所有文本分类请求路由到最便宜的可用模型,并记录冷却时间。' 然后它会自动探测密钥、建立路由表,之后每次请求自动选择最优模型,当遇到429时自动冷却,避免重复失败。
介绍
你是否经常因为免费API的速率限制而中断AI调用,或者面对多个模型不知如何选择?free-tier-ai-router 是一个配额感知的LLM路由器,它自动探测每个免费API密钥(支持Gemini、Mistral、OpenRouter、Kilo、Cerebras等)上每个模型的真实质量与官方速率限制,然后根据任务需求将请求路由到最便宜的可用模型。它会优先使用配额充裕的容量,把稀缺的每日配额留给真正需要的时刻,从而最大化从免费层中榨取的可用AI能力。
使用方法非常简单:你只需提供一组API密钥,路由器会自动进行探测和路由。它会在本地持久化冷却时间(cooldown),即使一个进程遇到429限流,下一个进程也会自动遵守,避免重复撞墙。你还可以配置任务对质量、速度、成本的要求,路由器会智能选择最佳模型。
这个工具特别适合需要大量调用LLM但预算有限的开发者或团队,例如:运行多个AI Agent的智能体应用、需要频繁调用不同模型进行对比测试、在免费额度内尽可能多地完成推理任务。它也适用于“所有模型都失败”的兜底场景,或者需要决定使用哪个提供商密钥的决策场景。
使用建议:先对所有密钥进行一次完整的探测(probe),以获得准确的模型质量和速率数据。注意,免费层的速率限制通常较低,路由器虽然能优化路由,但无法突破提供商的硬性限制。此外,如果任务对延迟极其敏感,路由器可能因探测和路由决策引入额外开销,建议在非实时场景中使用。
核心特点
与通用的API负载均衡器不同,free-tier-ai-router 不仅做轮询或随机分配,而是主动探测每个模型的真实质量与官方速率限制,并持久化冷却时间,确保跨进程的限流感知,从而在免费层中实现最优的配额利用。
注意事项
不适合需要极低延迟且对路由决策开销敏感的场景,也不支持超过免费层配额的无限制调用。
常见问题
支持哪些AI提供商?
支持Gemini、Mistral、OpenRouter、Kilo、Cerebras等,具体列表可查看仓库文档。
如何配置冷却时间持久化?
路由器会自动将冷却时间写入磁盘文件,默认路径可在配置中修改,重启后仍生效。
给 AI 助手的安装指引
如果你的 AI 编程助手(Claude Code、Cursor、TRAE 等)能看到这个页面,把下面这段发给它即可自动完成安装:
请访问 https://321skill.com/skills/free-tier-ai-router/raw/index.md 读取 free-tier-ai-router 的原始 Skill 定义(Markdown 格式),按其中说明在我的环境里完成安装和配置。
AI 可直接读取的原始 Markdown 地址:/skills/free-tier-ai-router/raw/index.md(查看排版版本)