Agent Skills
返回列表
截图OCR文字提取师

截图OCR文字提取师

办公效率 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_af163eaa/z-ocr-grab。

技能介绍

问题

截图、照片或系统界面里的文字往往不能直接复制,尤其在表格、多栏版式、低对比度图片里,人工誊录很容易漏字、串行或改变层级。工程师通常需要的不是“再描述一下图片”,而是可继续编辑、可粘贴到文档或代码块里的纯文本。

工作方式

该技能把截图 OCR 做成一个可预期的工作流,而不是单次图像描述:

  • 收图确认:先检查图片类型,确认是否存在表格、多栏、代码片段或密集注释。
  • OCR 提取:如果平台支持图像输入,就直接读取图中文字;如果不支持,则给出 tesseract、paddleocr 等本地工具的调用方向。
  • 排版校对:按原文结构还原段落,去除噪点,修正明显的错字、断行和顺序错误。
  • 输出文本:默认只在对话中输出结果,不擅自保存到本地;若需要写文件,则提示开启相应文件访问权限。

适用边界

默认纯本地处理,不联网拉取外部资源;不处理涉密或隐私截图,也不篡改原文。它适合做文本初稿、资料整理和格式转换,但政策判断、专业校对仍需要人工复核。

使用场景

  • 从系统报错截图中提取日志文本,整理成可粘贴的排查笔记。
  • 把会议白板照片里的多栏要点识别出来,补成结构化行动项。
  • 将客户反馈截图中的文字转成纯文本,便于归档和后续检索。
  • 识别产品文档截图里的表格说明,还原成可编辑的文字段落。

适合人员

  • 需要把界面报错截图转成可复制日志文本的前端工程师
  • 要把客户反馈截图归档并检索的产品运营
  • 需要从文档截图里还原表格说明的技术写作者
  • 希望把白板照片转成行动项的项目经理