Kimi 网页桥 Pro
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9ed681d6/kimi-webbridge-pro。
技能介绍
解决的问题
很多浏览器自动化任务卡不在“能不能点击”,而在“会不会误伤用户状态”。如果 Agent 直接操作当前浏览器,很容易把用户的登录标签页当成任务标签页关闭,或者在页面尚未加载、弹出窗口被拦截、单页应用就地更新时反复点击。
Kimi WebBridge Pro 针对这个场景,让 AI Agent 通过本地守护进程 http://127.0.0.1:10086 控制用户浏览器,而不是临时起一个隔离环境。它把“用户标签页”和“任务标签页”分开处理:已有登录态或当前页面用 find_tab,需要新建并稍后清理的页面用 navigate 加 newTab:true。
工作方式
技能的核心流程比较明确:
- 先做只读检查:通过
doctor.py或 readiness 报告确认二进制、守护进程、端口、PID 和扩展连接是否可用。 - 建立稳定会话:为一次任务分配一个稳定的 session 名,避免动作散落到多个上下文。
- 读取页面状态:用
snapshot获取 URL、标题、可访问文本和@e参考;未知页面先跑snapshot.py --auto,小页面返回紧凑结果,大页面写入 UTF-8 JSON 文件。 - 执行最小动作:根据快照中的
@e参考做click、fill,或用evaluate读取有边界的页面状态。 - 等待与恢复:导航或点击后使用
wait_for.py检查 URL、标题或文本;如果页面看起来没变,再检查list_tabs、弹窗拦截和真实链接。
这套设计的好处是把浏览器控制收敛到几个可解释的步骤上,减少“猜 DOM”的空间。
边界与注意点
这个技能不是通用爬虫,也不适合绕过安全机制。使用时应遵守几条限制:
- 不关闭用户标签页:
find_tab找到的是用户拥有的页面,除非用户明确要求,否则不能close_tab。 - 不读取敏感状态:不要主动返回 cookies、授权头、session token、密码字段、浏览器存储或与任务无关的私人内容。
- 不绕过站点控制:不尝试 CAPTCHA、paywall、年龄验证、浏览器警告或其他安全门。
- 临时文件要清理:截图、PDF 或大快照如果不是用户要求保留,用完后应删除。
更适合的场景是:Agent 需要基于当前浏览器登录态完成表单填写、内容提取、页面状态检查、截图取证,或诊断“点了但没跳过去”的问题。
使用场景
- 为 AI Agent 在用户已登录的浏览器里查找现有标签页,读取页面快照并完成表单填写,避免重复登录。
- 让 Agent 用 `newTab:true` 打开任务页面,执行点击、填写和截图,结束后只关闭任务标签页。
- 排查点击后页面未跳转、弹窗被拦截或目标打开在后台标签页的问题,并用 `list_tabs` 恢复真实链接。
- 对未知长度页面先用 `snapshot.py --auto` 提取文本,需要控件时再用 compact 模式读取可交互元素。
适合人员
- 需要让 AI Agent 在现有浏览器登录态中执行网页操作的 Agent 工程师。
- 调试本地浏览器守护进程、快照脚本和会话清理流程的自动化工程师。
- 构建网页表单填写、内容提取和截图取证功能的 AI 应用开发者。
- 需要处理弹窗拦截、后台标签页恢复和有界页面状态读取的 RPA 工程师。