截图OCR文字提取师
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_af163eaa/z-ocr-grab。
技能介绍
问题
截图、照片或系统界面里的文字往往不能直接复制,尤其在表格、多栏版式、低对比度图片里,人工誊录很容易漏字、串行或改变层级。工程师通常需要的不是“再描述一下图片”,而是可继续编辑、可粘贴到文档或代码块里的纯文本。
工作方式
该技能把截图 OCR 做成一个可预期的工作流,而不是单次图像描述:
- 收图确认:先检查图片类型,确认是否存在表格、多栏、代码片段或密集注释。
- OCR 提取:如果平台支持图像输入,就直接读取图中文字;如果不支持,则给出
tesseract、paddleocr等本地工具的调用方向。 - 排版校对:按原文结构还原段落,去除噪点,修正明显的错字、断行和顺序错误。
- 输出文本:默认只在对话中输出结果,不擅自保存到本地;若需要写文件,则提示开启相应文件访问权限。
适用边界
默认纯本地处理,不联网拉取外部资源;不处理涉密或隐私截图,也不篡改原文。它适合做文本初稿、资料整理和格式转换,但政策判断、专业校对仍需要人工复核。
使用场景
- 从系统报错截图中提取日志文本,整理成可粘贴的排查笔记。
- 把会议白板照片里的多栏要点识别出来,补成结构化行动项。
- 将客户反馈截图中的文字转成纯文本,便于归档和后续检索。
- 识别产品文档截图里的表格说明,还原成可编辑的文字段落。
适合人员
- 需要把界面报错截图转成可复制日志文本的前端工程师
- 要把客户反馈截图归档并检索的产品运营
- 需要从文档截图里还原表格说明的技术写作者
- 希望把白板照片转成行动项的项目经理