Agent Skills
返回列表
Gxpcode 专业翻译

Gxpcode 专业翻译

办公效率 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_321f4e87/zhonghe1991。

技能介绍

解决的问题

技术文档翻译常卡在术语一致性、PDF 版式信息和中文表达自然度上。直接让 LLM 翻译长 PDF,容易出现术语漂移、页间上下文丢失,以及“be done → 被处理”这类机械译法。Gxpcode-translator 把翻译流程拆成可执行步骤,先用术语词典约束 LLM,再把 PDF 解析为逐页素材后分页翻译并合并校验。

核心工作方式

  • 配置与路由:首次会引导写入 config.json,文本和 PDF 走不同步骤序列。
  • PDF 解析:通过 paddleocr/ 生成逐页 Markdown 与 elements JSON,并执行截断修复。
  • 术语扫描:term_matcher.py 用 AC 自动机和词边界匹配 CSV 词典中的 en,cn,explain 术语。
  • 翻译与导出:LLM 基于术语映射生成译文;PDF 结果经过 step4_merge.py 合并校验,导出双语 HTML 和 Markdown,并写入日志。

注意点

它适合有明确术语表的办公、产品、技术文档翻译。纯文本模式直接返回译文,PDF 模式更关注文件产出路径;若词典缺失或 PDF 结构复杂,仍需检查中间产物和校验结果。

使用场景

  • 把含 API 字段的中英文 PDF 产品手册翻成中文,并要求术语按内部 CSV 词典一致。
  • 翻译一段包含状态机英文说明的技术文档,先扫描术语再让 LLM 输出自然中文。
  • 将英文 PDF 报告生成双语对照 HTML 与 Markdown,便于在网页和代码库中查看。
  • 处理 OCR 后的 PDF 页面文本,修复截断并完成逐页翻译与合并校验。

适合人员

  • 维护产品术语表的技术文档编辑:需要把英文发布材料翻成中文并保证字段名一致。
  • 阅读英文 API 文档的后端工程师:需要把 PDF 规格转成双语 HTML 和 Markdown 供评审。
  • 处理客户合同附件的商务运营:需要提取 PDF 关键条款并输出中文对照版本。
  • 做本地化验收的 QA:需要按内部术语 CSV 检查翻译后的 PDF 译文质量。