Ollama 模型路由
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-ollama-model-router 到你的 AI 助手中。
技能介绍
解决的问题
OpenClaw 会话通常默认用单一模型处理所有请求,但代码、推理、创作、数据分析对模型能力、延迟和隐私要求不同。这个技能把任务路由拆出来,让系统先判断任务类型,再从 ~/.openclaw/model-registry.json 中选择可用模型,避免所有请求都打到昂贵云模型,也避免简单任务本地模型不够用。
如何工作
它围绕三件事:任务分类、模型注册和回退链。分类采用关键词匹配,也允许可选 LLM 分类,把请求映射到 coding、reasoning、creative、analysis、technical、general 等类型,并给出优先模型与回退模型,例如编码任务偏向 qwen2.5-coder、phi4,通用或敏感任务可落到 kimi-k2.6、llama3.3-70b。路由时会先检查可用模型,再按优先表选择;若首选不可用,会按同级能力、不同提供方、通用模型、默认模型的顺序降级。支持手动路由、自动路由和会话级覆盖,适合在隐私敏感、延迟敏感或成本敏感的任务间切换本地与云端模型。
适用边界
它不是模型管理工具,不负责安装、微调或容量规划;效果取决于你配置的模型清单、提供方名称和 OpenClaw 的集成状态。关键词规则对模糊任务可能误分类,复杂业务最好配合 session override 或自动路由白名单使用。
使用场景
- 在 OpenClaw 会话里收到修 bug、refactor 请求时,把任务路由到 qwen2.5-coder 或 phi4 并设置回退。
- 对含敏感数据的摘要、parse 任务,优先选择本地模型,避免发送到云模型。
- 当首选模型不可用或延迟偏高时,按同级能力、通用模型顺序降级到 kimi-k2.6。
- 在同一会话中切换编码、分析、creative 请求,用 session override 指定不同模型。
适合人员
- 维护 OpenClaw 个人助手的工程师,希望按任务类型选择不同本地模型
- 处理代码调试与配置部署的开发者,需要控制云模型调用成本
- 做数据摘要和敏感分析的团队成员,想把特定请求固定到本地模型
- 搭建多模型工作台的 Agent 开发者,需要可配置的路由和回退链