Web 工具决策策略
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9ca58e78/ddd。
技能介绍
问题背景
网页信息获取常被误当成固定链路:先搜索、再抓取、失败就浏览器。但真实场景里,URL 是否已知、页面是否静态、是否需要登录或交互,决定了工具选择。这个技能把 web_search、web_fetch、opencli、browser 视为分支决策,而不是层级降级,避免在不需要时打开重量级浏览器,也避免静默失败。
工作方式
技能的核心是一套 ReAct 式策略:
- 无明确 URL:先用
web_search获取线索,再根据返回 URL 判断下一步。 - 静态内容已知 URL:用
web_fetch获取文章、文档、API、RSS 等内容。 - 结构化数据需求:当搜索或抓取失败,且目标属于常见网站时,优先尝试
opencli,它比浏览器更轻量。 - 动态、登录、交互、截图:再升级到
browser,执行等待元素、CSS 选择器定位、点击输入或截图等操作。
关键约束是:每次切换工具都需要说明原因;登录和不可逆操作必须获得用户确认;页面等待要基于关键元素而非固定 sleep。web_search 失败时,技能会引导读取配置文档并按流程补齐 API 配置,用户明确拒绝后才进入降级方案。
适用边界
它适合处理公开资料检索、网页正文提取、已知站点的结构化读取,以及需要登录态或交互的受限页面。遇到 CAPTCHA、验证码、支付、发帖、删除等高风险场景时,它要求暂停并让用户介入,而不是自动绕过。若目标网站不在常见站点列表,且 web_fetch 返回空白、403 或骨架 HTML,则应准备人工判断或等待用户补充 URL 与凭证。
使用场景
- 排查竞品官网公告变更,先搜索最新 URL,再抓取静态新闻页正文,失败时换 opencli 或 browser。
- 读取已知 API 文档或 RSS 源,用 web_fetch 取正文,空白/403 时再升级到 opencli/browser。
- 抓取知乎回答或微博 feed 等 JS 渲染内容,用 browser 等待元素、点击翻页并提取文本。
- 处理登录后台报表页,先告知用户并取得确认,再复用同一浏览器上下文执行筛选和截图。
适合人员
- 维护 AI Agent 工具链的工程师,希望按场景选择 web_search、web_fetch、opencli 或 browser 并说明降级原因。
- 做信息抓取脚本的工程师,需要处理静态页面、JS 渲染页、登录态和 CAPTCHA 的边界。
- 运营或分析师,需要抓取竞品公告、微博 feed、知乎回答等受限或动态网页内容。
- 测试或自动化工程师,需要在登录后台执行筛选、翻页、截图并保留同一浏览器上下文。