浏览器自动化
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @zcwl/browser-automation。
技能介绍
要解决的问题
网页交互常包含导航、点击、表单填写、动态加载和结果提取,手动操作容易重复且难复用;手写 Python / JavaScript 脚本又要维护选择器、重试、代理与异常处理。本技能用自然语言描述任务,通过 CLI 调用无头浏览器完成这些步骤。
工作方式
- 会话初始化:启动无头浏览器实例,配置代理与
User-Agent。 - 页面操作:根据指令执行导航、点击、输入、等待和提取。
- 结果返回:以
json、text或markdown输出结构化数据,并可附带截图。 - 异常处理:遇到页面超时、选择器失效或反爬触发时,可调整超时、降低频率、更换
User-Agent,或用可访问性树定位元素。
适用边界
它适合重复性网页操作、数据提取、页面测试类任务;不适合需要复杂业务判断、风险决策或绕过强认证的场景。调用时仍需关注目标站点条款、请求频率和敏感数据处理。
使用场景
- QA 工程师在无头浏览器中按测试用例执行导航、点击、输入,并检查结构化结果和截图。
- 数据工程师用自然语言让技能打开目标页面,提取字段并输出 `json` 供后续入库。
- 自动化工程师在 CI 中调用 CLI 排查页面加载超时、选择器失效或反爬重试问题。
- 运营人员按指令填写网页表单,并将操作结果导出为 `markdown` 报告。
适合人员
- 想把重复网页操作改成 CLI 指令的前端工程师。
- 需要从动态页面抓取结构化数据的数据工程师。
- 要在无头浏览器中执行页面测试的 QA 工程师。
- 用 AI Agent 管理网页交互任务的自动化工程师。