Agent Skills
返回列表
免费 API 用量优化

免费 API 用量优化

AI Agent 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_4baa9e94/apiusageoptimization 到你的 AI 助手中。

技能介绍

解决什么问题

多平台免费模型看似能降低调用成本,但实际接入时往往要手工维护模型列表、比较免费额度、判断任务该走哪个模型,并在主模型限流或失败时切换到备用模型。对于同时使用多个 API Key 的工程师来说,这类配置容易散落,且免费额度、QPS 和可用性变化快。

技能如何工作

该技能把免费模型接入拆成几个可执行步骤:

  • 自动发现:通过 discover.js 刷新可用免费模型,减少手工整理成本。
  • 智能分流:通过 router.js 按任务类型路由,例如简单对话、翻译可优先免费模型,复杂代码、推理、视觉任务可优先主模型。
  • 无感降级:通过 fallback.js 在主模型失败时切到备用模型,并支持回切策略。
  • 三种模式:royal、balanced、savings 分别对应主模型优先、成本与质量平衡、免费优先。

配置时通常需要先准备 OPENROUTER_API_KEY,可选 SILICONFLOW_API_KEY、DEEPSEEK_API_KEY、ZHIPU_API_KEY、NVIDIA_API_KEY,再生成并应用配置。

适用边界

它适合需要管理多个免费或低成本模型 API 的本地工作流,不适合依赖完全无限制免费额度的场景。免费模型可能有 QPS、总量或随时调整;生产环境建议至少配置 2-3 个备用模型,并不要把 API Key 提交到代码仓库。

使用场景

  • 配置多平台免费模型路由,让翻译/写作优先走免费模型,代码推理保留主模型。
  • 主模型限流或失败时自动切到 SiliconFlow/OpenRouter 备用模型并回切。
  • 每日刷新 OpenRouter 免费模型列表,清理失效 key 或不可用模型。
  • 预算敏感时切换省钱模式,将 primary 改为免费模型,原主模型兜底。

适合人员

  • 需要同时管理多个 LLM API Key 的工程师,希望按任务路由降低调用成本。
  • 使用 Coding Plan/付费 API 的个人开发者,希望免费模型只在主模型失败时兜底。
  • 成本敏感的独立开发者,希望把对话、翻译等任务切到免费模型。
  • 维护 Agent 工作流的后端工程师,希望给多模型客户端加 fallback 与分流配置。