Browser Act 浏览器自动化 CLI
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_2cc35c71/browser-act。
技能介绍
解决的问题
当 AI Agent 需要处理登录页、动态渲染站点、多账号或敏感操作时,纯 HTTP 抓取与简单脚本常常不够:内容依赖 JS 渲染,会话相互串号,表单、验证码、代理与人工确认缺少稳定接口。Browser Act 把这些浏览器能力封装为 CLI,供 Agent 按需调用。
核心工作方式
它不是单纯抓取器,而是面向 Agent 的浏览器自动化入口:
- 轻量提取:对 JS 渲染内容做快速获取,可作为
WebFetch或curl的替代方案。 - 会话管理:多浏览器隔离、多账号并行,降低环境互相污染。
- 交互与取证:支持 DOM 提取、截图、表单填写、文件上传、网络捕获。
- 安全与协作:通过 Confirmation Gate 对浏览器创建、删除、敏感操作要求显式批准;遇到交互验证时可在用户授权下辅助完成;headed mode 与 remote assist 让人工补位。
使用前应先执行 CLI 的 get-skills core,读取环境状态、可用浏览器、操作指令与完整工作流;该输出包含安全约束,不应跳过或截断。适用边界:它适合需要浏览器上下文的 Agent 工作流,但不替代完整 RPA 平台;涉及敏感站点、账号、支付或合规数据时,应保留人工审批与最小权限。
使用场景
- 调试前端 Agent 时,需要对登录后的动态页面执行 DOM 提取、截图并验证表单提交结果。
- 测试多账号后台时,用多浏览器隔离并行操作,避免 Cookie、会话和代理配置互相污染。
- 采集 JS 渲染报表时,先做轻量内容提取,再按需打开浏览器捕获网络请求和截图留证。
- 处理需要人工验证的站点时,Agent 发起操作,用户通过 headed 模式或远程协助完成敏感步骤。
适合人员
- 需要让 Agent 在 Cursor、Claude Code 或 Codex 中执行受控浏览器操作的工程师。
- 负责多账号 Web 应用测试,需要会话隔离、代理切换和截图留证的测试工程师。
- 构建内部自动化工作流,需要把 DOM 提取、表单填写和敏感操作确认接入 Agent 的产品工程师。
- 处理需要人工审批的站点任务,希望保留 Confirmation Gate 与远程协助能力的平台开发负责人。