Agent Skills
返回列表
何药师卫生信息标准识别与解读

何药师卫生信息标准识别与解读

知识管理 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_bc8a2262/he-standard。

技能介绍

问题

卫生信息标准文档常以 PDF、Word、扫描图片存在,内容混杂代码表、数据集、术语集、信息系统功能集。人工阅读并整理列头、字段、业务类型容易遗漏,且格式不统一。这个技能面向需要把标准文档转为可查询、可复核表格的工程师或信息管理人员。

工作方式

技能先确认数据来源:可通过 IMA知识库 搜索并下载文档,也可扫描本地文件夹中的 PDF、Word、图片。随后对每个文档执行提取与识别:使用 pdfplumber、python-docx 或 OCR 获取文本;通过正则识别 WS/T、GB/T、YY 等标准编号与标题;再按关键词和结构判断文档中的 代码表、数据集、术语集、信息系统功能集 与 标准介绍表。
最终每个标准生成一个 Excel,文件名形如 {标准编号}_{标准标题}.xlsx,并按识别到的类型建立 Sheet;若匹配到业务类型,会额外写入 业务类型规则 Sheet。脚本 scripts/parse_standard.py 负责文档解析、字段提取和输出。

边界与注意

该技能不是全文语义分析,业务类型匹配仍基于关键词启发式,需人工审核。扫描版 PDF 或图片依赖 OCR,低质量扫描件可能漏字。超过 100 页的文档建议单独处理,避免长时间等待和失败定位困难。

使用场景

  • 信息科收到一批扫描版卫生信息标准PDF,需要提取标准编号、数据集字段并生成Excel。
  • 整理本地文件夹中的WS/T标准文档,按代码表、术语集、信息系统功能集输出统一Excel。
  • 从IMA知识库读取某项卫生信息标准,解析标准介绍表与业务类型规则并导出到桌面。
  • 核对某版YY标准的数据集和数据元定义,生成含数据类型与表示格式的Sheet。

适合人员

  • 医院信息科工程师:把分散的卫生信息标准文档转成可导入系统开发的字段清单。
  • 卫生标准管理人员:核对数据元、代码表和术语集,形成统一格式的Excel底稿。
  • 医疗信息化项目顾问:从IMA知识库提取标准功能集,支撑系统功能范围梳理。
  • 数据治理专员:将扫描件或Word标准解析为结构化表,便于人工审核。