Agent Skills
返回列表
网页访问

网页访问

数据分析 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_87fe1a85/gwchen06。

技能介绍

解决什么问题

很多网页任务不是简单“搜索后读取正文”。登录后台、组织内系统、动态渲染页面、折叠内容、懒加载图片、视频关键帧等,都会让 WebSearch、WebFetch、curl 停在表层。这个技能面向需要进入真实浏览器上下文完成检索、提取与交互的场景。

工作方式

它先检查 Node.js 22+、浏览器调试端口和 CDP Proxy,再通过 HTTP API 操作用户本机 Chromium 系浏览器。核心能力包括:

  • 静态与动态读取:已知 URL 可用 WebFetch、curl 或 Jina 预处理;需要原始结构时用 DOM 查询。
  • 浏览器内交互:通过 /eval、/click、/scroll、/screenshot 查看结构、点击、滚动、采帧,适合登录态与反爬页面。
  • 媒体与视频:从 DOM 提取图片 URL,操控 <video> 元素 seek 后截图,做离散内容分析。
  • 并行调研:多个独立目标可交给子 Agent 使用不同 targetId 并行处理,避免主 Agent 上下文被大量网页内容占满。

注意边界

该技能依赖本地浏览器与 CDP 连接,首次可能需要用户授权;密集打开页面可能触发风控。它不主动关闭用户已有 tab,完成自己的后台 tab 后应关闭。登录判断以“目标内容是否拿到”为准,未确认登录能解决问题前不贸然要求用户登录。站点经验文件应只记录验证过的事实,失效时回退通用模式。

使用场景

  • 调研多个项目时,让子 Agent 分别打开官网、文档和论坛,只把摘要回传给主 Agent。
  • 核对某项政策真伪时,先定位一手来源,再访问发布机构官网原文并记录出处。
  • 从动态页面提取懒加载图片 URL,并下载公开资源用于后续视觉分析。
  • 查询本机 Chrome 或 Edge 最近访问过的高频内部系统入口,定位公司面板。

适合人员

  • 需要访问登录后台或组织内系统,而不是公网文档的产品分析师。
  • 要核实多来源信息真伪,并优先读取官网、论文或官方新闻页的研究员。
  • 需要从动态网页提取 DOM、图片、视频帧等结构化素材的内容工程师。
  • 要把多个独立网页调研拆成并行任务,减少主上下文占用的 Agent 开发者。