Agent Skills
返回列表
UAP解密发布分析器

UAP解密发布分析器

知识管理 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-uap-release-analyzer。

技能介绍

要解决的问题

政府解密 UAP/UFO 文档通常是一批 PDF:文件名杂乱、来源机构不同、大量扫描件没有文本层,FOIA 涂改和保密标记分散在不同文件里。人工浏览只能得到零散印象,难以回答“哪些文件最关键”“哪些机构/地点反复出现”“哪一批文件涂改最多”。

技能如何工作

它把固定流水线打包成脚本:先用 inventory.py 建立文件清单,按文件名前缀识别 FBI、DOW、NASA、DOS、NARA 等来源;再用 extract_text.py 抽取有文本层的 PDF,并将无文本层文件标记为待 OCR;随后 analyze.py 统计实体、年份、机构×地点分布、人名出现频次和 FOIA 代码;最后 build_report.py 生成 REPORT.md。整个流程 幂等且可增量执行,同一目录重跑会跳过已完成部分。

适用边界与注意点

该技能面向已下载好的 FOIA 解密文档目录,适合做清单、摘要和模式识别,不默认执行 OCR,也不会把年份提及直接当作事件日期。若文件名前缀大量落入 OTHER,应先扩展 agency_vocab.md,而不是把数据当作异常。报告中的实体抽取基于关键词和正则,需要保留“缺失与限制”章节,避免把启发式结果当成正式 NER。

使用场景

  • 收到 release_01 目录后,按机构、页数、文件前缀生成首批清单。
  • 对比 release_01 和 release_02,找出新增文件、重复实体与涂改变化。
  • 统计 FBI、NARA 文件中的 (b)(1)、CUI 等标记,定位涂改最多的 PDF。
  • 对无文本层扫描件做缺失说明,并在报告中标记需要 OCR 的缺口。

适合人员

  • 研究 FOIA 解密档案的研究员,想把一批 UAP PDF 整理成可比较的清单。
  • 做公开情报分析的分析师,需要从 FBI/NARA 文件中找涂改代码与高频实体。
  • 维护 UAP 资料库的档案管理员,想统一输出每期 release 的摘要与缺口说明。
  • 分析政府 PDF 的数据工程人员,想把清单、文本抽取与报告生成脚本化。