Agent Skills
返回列表
知识产权官文自动归档

知识产权官文自动归档

办公效率 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_dcf8e29c/archive-ip-pdfs。

技能介绍

问题场景

知识产权团队经常收到一批专利、商标和软著官文 PDF,文件名不规范,目录散落,重复文件与状态变化混杂。人工重命名、核对申请号/注册号、判断法律状态并维护台账,容易遗漏且难以复核。

工作方式

该技能面向目录级 PDF 批量处理:递归扫描 --input 指定目录,识别专利、商标、软著三类文件,并提取申请号、通知书名称、权利人等字段。随后按命名规则重命名,写入组织化目录,并生成汇总报表;同一知识产权只保留最新状态记录。

核心流程包括:

  • PDF 解析:优先 pdfplumber,可降级到 PyMuPDF 或 PyPDF2
  • 法律状态判定:按证书、通知书、登记簿等优先级生成状态,如专利“授权”“实审”“驳回”
  • CSV 管理:自动检测编码,输出使用 UTF-8-BOM,便于 Excel 打开
  • 幂等归档:根据申请号、注册号、登记号等组合键避免重复写入

适用边界

适合已有成批官文 PDF 的归档与台账整理,尤其适合需要统一目录结构和最新状态汇总的场景。它依赖 Python 3.10+ 与至少一个 PDF 解析库;对扫描型无文字层 PDF、字段提取不清或命名规则特殊的数据,仍需人工复核。

使用场景

  • 每月收到几十份专利通知书和商标受理文件,需要统一重命名并归档到申请号目录。
  • 代理所批量交付软著受理通知和证书 PDF,需要识别文件类型并生成最新状态台账。
  • 案件台账混乱,需要用专利证书、驳回通知书和登记簿副本判断当前法律状态。
  • 历史官文重复归档,需要按申请号、通知书名称等去重并保留最新记录。

适合人员

  • 负责专利、商标、软著台账的知识产权专员,需要把散乱官文 PDF 整理成统一目录。
  • 需要定期核对申请状态变化的专利代理助理,想用通知书和证书自动判断最新法律状态。
  • 管理案件档案的知识产权运营,需要按权利人、申请号和状态批量归档文件。
  • 需要把官文解析结果导出 Excel 的法务分析师,想要 UTF-8-BOM CSV 汇总报表。