免费 API 用量优化
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_4baa9e94/apiusageoptimization 到你的 AI 助手中。
技能介绍
解决什么问题
多平台免费模型看似能降低调用成本,但实际接入时往往要手工维护模型列表、比较免费额度、判断任务该走哪个模型,并在主模型限流或失败时切换到备用模型。对于同时使用多个 API Key 的工程师来说,这类配置容易散落,且免费额度、QPS 和可用性变化快。
技能如何工作
该技能把免费模型接入拆成几个可执行步骤:
- 自动发现:通过
discover.js刷新可用免费模型,减少手工整理成本。 - 智能分流:通过
router.js按任务类型路由,例如简单对话、翻译可优先免费模型,复杂代码、推理、视觉任务可优先主模型。 - 无感降级:通过
fallback.js在主模型失败时切到备用模型,并支持回切策略。 - 三种模式:
royal、balanced、savings分别对应主模型优先、成本与质量平衡、免费优先。
配置时通常需要先准备 OPENROUTER_API_KEY,可选 SILICONFLOW_API_KEY、DEEPSEEK_API_KEY、ZHIPU_API_KEY、NVIDIA_API_KEY,再生成并应用配置。
适用边界
它适合需要管理多个免费或低成本模型 API 的本地工作流,不适合依赖完全无限制免费额度的场景。免费模型可能有 QPS、总量或随时调整;生产环境建议至少配置 2-3 个备用模型,并不要把 API Key 提交到代码仓库。
使用场景
- 配置多平台免费模型路由,让翻译/写作优先走免费模型,代码推理保留主模型。
- 主模型限流或失败时自动切到 SiliconFlow/OpenRouter 备用模型并回切。
- 每日刷新 OpenRouter 免费模型列表,清理失效 key 或不可用模型。
- 预算敏感时切换省钱模式,将 primary 改为免费模型,原主模型兜底。
适合人员
- 需要同时管理多个 LLM API Key 的工程师,希望按任务路由降低调用成本。
- 使用 Coding Plan/付费 API 的个人开发者,希望免费模型只在主模型失败时兜底。
- 成本敏感的独立开发者,希望把对话、翻译等任务切到免费模型。
- 维护 Agent 工作流的后端工程师,希望给多模型客户端加 fallback 与分流配置。