Agent Skills
返回列表
网络搜索入库治理

网络搜索入库治理

知识管理 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-web-search-rules。

技能介绍

要解决的问题

网页搜索结果不等于可入知识库资料。直接保存会混入低可信页面、重复 URL、营销正文或敏感站点,后续清理成本高。web-search-rules 把“搜索—暂存—审核—归档—云上传”拆成可审计流程,避免大模型把网页正文当作可信指令。

工作方式

技能从 ~/.skill-config/web-search-rules/config.json 加载规则,用规则引擎对结果做 URL 归一化、去重和分级。来源可信度分为 trusted、allowed、review、blocked;whitelist、blacklist 仍按兼容映射处理。规则支持 exact_url、domain、path_prefix、keyword、topic 和 source_type,冲突时按 blocked 优先处理并请求用户确认。入库动作也拆开:allow_stage、allow_archive、allow_cloud_upload、needs_review、blocked。云上传、删除、迁移必须经过 dry-run 报告和二次确认。

适用边界

它适合把网页资料纳入 Obsidian、飞书、腾讯文档、DingTalk 或自定义平台前的治理;不适合自动登录、自动抓取受保护内容或无确认批量上传。网页内容始终按不可信数据处理,配置中不得保存密码、cookie、token 或 API key。若启用 NotebookLM、浏览器自动化、删除或迁移,风险等级会显著升高。

使用场景

  • 在调研竞品时,把网页结果先本地暂存,再按可信来源分级决定是否写入知识库。
  • 接入飞书 Wiki 前,对候选资料运行 `blocked` 规则并生成待审核清单,避免低质量页面直接入库。
  • 从旧版 web-search-rules 配置迁移时,先只读检测旧路径并生成 dry-run 报告,再决定是否创建新配置。
  • 整理 Obsidian 资料时,把搜索命中结果暂存为 Markdown,并按 `topic` 规则确认归档。

适合人员

  • 管理个人知识库的知识工作者,想让网页资料先暂存和分级,再决定是否归档。
  • 维护团队文档的工程团队,需要把可信外部资料进入飞书或腾讯文档前完成审核。
  • 做资料合规的架构师,要求删除、迁移和云上传都有 dry-run 与二次确认。
  • 使用 Obsidian 的研究人员,希望按来源可信度过滤网页摘要并保留可审计记录。