Agent Skills
返回列表
MacOCR macOS 文字识别

MacOCR macOS 文字识别

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_9a66f56b/macos-ocr。

技能介绍

问题

在 macOS 上处理截图、照片、扫描文档或收据时,常见需求是把图片中的文字提取出来,再粘贴到编辑器、表格或终端脚本里。纯前端 OCR 往往依赖额外模型服务,而 MacOCR 选择直接使用系统自带能力,减少跨平台组件和网络依赖。

工作方式

  • 核心能力:使用 macOS 原生 Vision 框架识别图片文字,支持 PNG、JPEG、TIFF、BMP 等常见格式。
  • 语言范围:主要面向简体中文 zh-Hans、繁体中文 zh-Hant 和英文 en-US。
  • 输出约定:识别结果按文本块逐行写入 stdout,方便被 shell 管道继续处理;未识别到文字时输出为空。
  • 错误处理:图片无法加载或识别失败时,错误信息写入 stderr,并以退出码 1 表示失败,便于脚本判断。

适用边界

  • 仅适用于支持 Vision 框架的 macOS 系统(macOS 10.15+)。
  • 需要本机可用 swift 命令。
  • 它适合本地图片文字提取,不适用于远程文件、批量服务化调用或中文/英文以外的语言识别。

使用场景

  • 在 macOS 终端里把报错截图转成可复制文字,再粘贴到工单描述中。
  • 把 PDF 页面导出成 PNG 后,提取收据上的金额、日期和商家名称。
  • 将扫描的发票照片转成文本块,逐行复制到电子表格里进行核对。
  • 在 macOS 上读取界面截图中的字段值,供自动化脚本写入日志。

适合人员

  • 处理 macOS 截图和照片的前端工程师,想把报错界面文字快速提取到工单里。
  • 整理发票、收据和扫描文档的财务助理,需要把图片中的金额和日期转成文本核对。
  • 写本地自动化脚本的运维工程师,希望从界面截图中读取字段值并写入日志。
  • 在 Mac 上处理合同扫描件的法律助理,需要提取截图中的条款文字供后续编辑。