Agent Skills
返回列表
💻

浏览器自动化助手

开发编程 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_c562f70c/browser-auto。

技能介绍

解决网页自动化中的常见挑战

在开发或数据采集任务中,经常需要与浏览器进行自动化交互,例如自动填写表单、抓取页面数据或管理多个标签页。这些操作涉及动态内容加载、元素定位不稳定、登录认证复杂以及网站反爬措施,手动处理效率低下且容易出错。

核心能力与关键步骤

该技能提供了一套系统化的浏览器自动化操作指南,覆盖以下核心功能:

  • 导航与等待:使用 page.goto() 等方法导航到目标 URL,并确保页面加载完成。关键在于合理设置超时和等待策略,避免因网络延迟导致操作失败。
  • 元素交互:通过语义化选择器(如 text=data-testid=role=)定位元素,执行点击、输入等操作。避免使用脆弱的 CSS/XPath 索引选择器,如 :nth-child(3)
  • 多标签管理:支持打开、切换和关闭多个标签页,适用于需要并行处理或多窗口操作的场景。
  • 数据采集:从页面中提取文本、属性或结构化数据,结合滚动和等待机制确保内容加载完全。
  • 登录与认证:自动化登录流程,处理用户名/密码输入和提交,但需注意验证码等需要人工介入的情况。
  • 文件操作:自动化文件上传和下载,确保路径正确和文件完整性。
  • 错误处理:设计重试机制和超时处理,应对网络波动或元素不可见等异常情况。

每个步骤都强调最佳实践,例如操作前等待元素就绪、验证操作结果而非假设成功,以及使用随机延迟(100-300ms)避免触发反爬检测。

适用边界与注意事项

虽然该技能增强了浏览器自动化能力,但使用时必须遵守法律法规和网站规则:

  • 遵守 robots.txt 和使用条款:自动化操作应尊重网站的爬虫协议。
  • 控制请求频率:合理设置请求间隔,避免对服务器造成压力。
  • 登录凭证安全:不硬编码密码或 Token,使用环境变量或安全存储。
  • 处理验证码和滑块:这些环节通常需要人工干预,无法完全自动化。
  • 反检测策略:调整 User-Agent、添加随机延迟,但需注意国内网站可能有更严格的反爬措施,如字体反爬或 CSS 偏移。
  • 工具集成:建议配合 Playwright、Selenium 或 Puppeteer 等自动化工具使用,以获得更稳定的执行环境。

总之,该技能为工程师提供了一个结构化的框架来处理浏览器自动化任务,但需结合具体场景和最佳实践进行调整,确保操作安全高效。

使用场景

  • 在电商平台大促前,需要自动登录多个店铺后台,批量更新商品库存和价格信息,以应对流量高峰。
  • 市场调研中,需从行业新闻网站自动采集标题、摘要和发布日期,用于生成趋势分析报告。
  • 开发 web 应用时,需要自动化填写用户注册表单,测试输入验证、错误提示和提交逻辑是否符合预期。
  • 运维工作中,需同时管理多个浏览器标签页,监控在线服务器状态仪表盘的实时数据变化。

适合人员

  • 每周需从多个竞品网站自动采集价格和促销数据的电商运营分析师。
  • 负责自动化测试 web 应用表单交互、多标签页导航和错误处理流程的 QA 工程师。
  • 需要定期从在线数据平台批量下载报表并同步到内部数据库的数据工程师。
  • 在内容管理系统中批量上传、编辑和发布多媒体文件的网站内容编辑。