Agent Skills
返回列表
浏览器自动化

浏览器自动化

AI Agent 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @zcwl/browser-automation。

技能介绍

要解决的问题

网页交互常包含导航、点击、表单填写、动态加载和结果提取,手动操作容易重复且难复用;手写 Python / JavaScript 脚本又要维护选择器、重试、代理与异常处理。本技能用自然语言描述任务,通过 CLI 调用无头浏览器完成这些步骤。

工作方式

  • 会话初始化:启动无头浏览器实例,配置代理与 User-Agent。
  • 页面操作:根据指令执行导航、点击、输入、等待和提取。
  • 结果返回:以 json、text 或 markdown 输出结构化数据,并可附带截图。
  • 异常处理:遇到页面超时、选择器失效或反爬触发时,可调整超时、降低频率、更换 User-Agent,或用可访问性树定位元素。

适用边界

它适合重复性网页操作、数据提取、页面测试类任务;不适合需要复杂业务判断、风险决策或绕过强认证的场景。调用时仍需关注目标站点条款、请求频率和敏感数据处理。

使用场景

  • QA 工程师在无头浏览器中按测试用例执行导航、点击、输入,并检查结构化结果和截图。
  • 数据工程师用自然语言让技能打开目标页面,提取字段并输出 `json` 供后续入库。
  • 自动化工程师在 CI 中调用 CLI 排查页面加载超时、选择器失效或反爬重试问题。
  • 运营人员按指令填写网页表单,并将操作结果导出为 `markdown` 报告。

适合人员

  • 想把重复网页操作改成 CLI 指令的前端工程师。
  • 需要从动态页面抓取结构化数据的数据工程师。
  • 要在无头浏览器中执行页面测试的 QA 工程师。
  • 用 AI Agent 管理网页交互任务的自动化工程师。