Agent Skills
返回列表
PDF英文课文生词对照生成器

PDF英文课文生词对照生成器

教育学习 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_a4ec1596/english-textbook-vocab。

技能介绍

问题场景

扫描版英文课文 PDF 常把正文、页码、练习和词汇表混在一起,直接复制文字会丢失段落结构;若再生成词汇表,容易出现左右错位、打印分页截断和排版不可控的问题。

工作方式

该技能围绕 PDF → 图片 → 识别 → 清理 → 生词对照 的流水线工作。先用 PyMuPDF 将页面转为 300 DPI 的 PNG,再用多模态模型识别英文文本,并在提示词中强调段落结构。随后剔除页眉、页脚、页码、练习和词汇表页,只保留章节标题与正文。流程按初中生水平筛选生词,将动词还原为原形,并去重。每个生词生成 IPA 音标、vi. / vt. 词性、中文释义、同源词和 1–3 个近义词,最终渲染成可打印的 A4 HTML。

适用边界

它适合把课文拆成段落级别对照,左侧正文使用 text-align: left,右侧词汇采用 #8B0000 加粗,章节标题使用 #003366。两栏对齐依赖每个 vocab-block 只包含一段课文和对应生词;竖线需要用真实 DOM 元素绘制,避免浏览器打印时丢失。若识别结果段落仍然粘连,需要回看 PNG 页面手动插入空行后再继续。

使用场景

  • 拿到扫描版英文课文 PDF,把章节正文提取出来,并按段落生成左侧课文、右侧生词的 A4 HTML。
  • 复习单元前,将 PDF 中 3-4 个自然段拆成 vocab-block,给每个生词补 IPA、vi/vt、中文释义和近义词。
  • 打印课堂讲义时,避免两栏错位和单词跨页截断,用真实 DOM 竖线生成可浏览器直接打印的对照页。
  • 处理含页眉、页码、练习页的教材图片,先剔除非正文,再只保留标题与段落文本做词汇整理。

适合人员

  • 初中英语老师:需要把扫描课文里的生词整理成可打印的两栏对照讲义。
  • 英语教研员:要将教材 PDF 段落化,并给生词补充音标、词性和近义词。
  • 自学初中生:想从英文课文 PDF 中提取目标单词,生成适合背诵的 A4 词汇页。
  • 课程内容编辑:需要清理扫描版 PDF 非正文,再生成排版稳定的词汇对照 HTML。