Agent Skills
返回列表
虾看

虾看

AI Agent 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,将 @user_bed45be1/claw-eyes 安装到 AI 助手中。

技能介绍

问题

很多文字模型本身不处理图片,遇到截图、UI 布局、报错信息或代码截图时,只能依赖用户手动描述。Claw Eyes 虾看 把这个问题拆成三步:捕获剪贴板图片、调用视觉模型生成文字描述、再把描述交回主模型,减少切换主模型的配置成本。

工作方式

  • 读图:从系统剪贴板读取图片;超过 800KB 的图片会压缩到 1920×1080 以内,降低传输和解析压力。
  • 分析:优先使用用户配置的 OpenAI 兼容视觉接口;如果接口不可用,再尝试 MCP 视觉工具作为备用。
  • 回传:根据内容输出界面元素、错误诊断、文档表格或代码复现,主模型基于这些文字继续推理。

端点、密钥和模型名通过 CLAW_EYES_API_URL、CLAW_EYES_API_KEY、CLAW_EYES_VISION_MODEL 等环境变量提供,技能本身不硬编码供应商信息。

适用边界

技能在用户明确要求“看图”时触发,主要面向剪贴板中的单张图片。未配置视觉 API 时,不应把图片发送到外部服务;API_URL 与 VISION_MODEL 必须来自同一供应商,Linux 环境还需要 xclip 或 wl-paste。

使用场景

  • 开发者截图报错弹窗,让 AI 读取剪贴板图片并提取错误关键字
  • 测试同学截取 UI 页面,要求 AI 描述按钮、输入框和异常提示
  • 工程师截图代码块,让 AI 识别语言并复现可运行版本
  • 文档作者截取表格,要求 AI 抽取字段值生成文字摘要

适合人员

  • 调试报错时希望从截图直接获取诊断线索的后端工程师
  • 需要把 UI 截图转成文字描述以便写缺陷报告的测试工程师
  • 使用纯文字大模型但不想切换主模型的 AI 应用开发者
  • 需要识别代码截图并整理成可复用片段的独立开发者