MacOCR macOS 文字识别
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9a66f56b/macos-ocr。
技能介绍
问题
在 macOS 上处理截图、照片、扫描文档或收据时,常见需求是把图片中的文字提取出来,再粘贴到编辑器、表格或终端脚本里。纯前端 OCR 往往依赖额外模型服务,而 MacOCR 选择直接使用系统自带能力,减少跨平台组件和网络依赖。
工作方式
- 核心能力:使用 macOS 原生
Vision框架识别图片文字,支持PNG、JPEG、TIFF、BMP等常见格式。 - 语言范围:主要面向简体中文
zh-Hans、繁体中文zh-Hant和英文en-US。 - 输出约定:识别结果按文本块逐行写入
stdout,方便被shell管道继续处理;未识别到文字时输出为空。 - 错误处理:图片无法加载或识别失败时,错误信息写入
stderr,并以退出码1表示失败,便于脚本判断。
适用边界
- 仅适用于支持 Vision 框架的 macOS 系统(
macOS 10.15+)。 - 需要本机可用
swift命令。 - 它适合本地图片文字提取,不适用于远程文件、批量服务化调用或中文/英文以外的语言识别。
使用场景
- 在 macOS 终端里把报错截图转成可复制文字,再粘贴到工单描述中。
- 把 PDF 页面导出成 PNG 后,提取收据上的金额、日期和商家名称。
- 将扫描的发票照片转成文本块,逐行复制到电子表格里进行核对。
- 在 macOS 上读取界面截图中的字段值,供自动化脚本写入日志。
适合人员
- 处理 macOS 截图和照片的前端工程师,想把报错界面文字快速提取到工单里。
- 整理发票、收据和扫描文档的财务助理,需要把图片中的金额和日期转成文本核对。
- 写本地自动化脚本的运维工程师,希望从界面截图中读取字段值并写入日志。
- 在 Mac 上处理合同扫描件的法律助理,需要提取截图中的条款文字供后续编辑。