Chrome AI Action 浏览器自动化
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_e71390e8/chromeskill。
技能介绍
要解决的问题
当 AI 需要“看到”并操作真实网页时,单纯调用 HTTP API 往往不够:页面可能动态渲染、需要点击、输入、读取表单、截取结果或拦截请求。chrome_skill 把这类浏览器交互封装为可被 agent 调用的动作,减少手工维护脚本的成本。
如何工作
它通过本地桥接服务与 Chrome 的 CDP 通道通信,支持导航、点击、输入、截图、内容提取、Cookie、LocalStorage、网络拦截、PDF 导出等 60+ 操作。典型流程是:先 navigate 打开页面,再用 waitForElement 等待关键内容,接着用 getText、getLinks、getFormFields 理解结构,然后执行 click、type、pressKey,最后用 screenshot 或 evaluate 校验结果。遇到未知页面,可先用 getFocusableElements 和 getAccessibilityTree 探测可交互元素。
适用边界
该技能适合浏览器操作,不适合纯代码生成、调试或无页面上下文的任务。需要本地 Chrome/Chromium 与 Node.js 18+;中文 URL 通常由桥接自动编码,但在终端输入乱码时可手动 encodeURIComponent。
使用场景
- 调试登录页时,自动打开表单、输入账号、点击按钮并截图留证。
- 抓取动态页面时,等待关键元素渲染,再提取链接、标题和可见文本。
- 验证前端改动时,打开目标 URL,检查控制台日志、网络请求和视口截图。
- 做竞品页分析时,提取表单字段、可聚焦元素和无障碍树,便于后续建模。
适合人员
- 负责端到端测试的前端工程师,需要稳定执行点击、输入、导航和结果截图。
- 做网页数据采集的爬虫工程师,需要从动态页面提取文本、链接、表单项与性能指标。
- 维护自动化测试的 QA 工程师,希望复用 CDP 操作完成登录、表单提交和 Cookie 校验。
- 开发浏览器插件或本地工具的产品工程师,需要调用 Chrome 的截图、PDF 导出和网络拦截能力。