Agent Skills
返回列表
网页文件摘要 CLI

网页文件摘要 CLI

知识管理 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_dd0cd521/cn20260415。

技能介绍

解决的问题

当需要把网页、本地文件或 YouTube 内容压缩成可入库、可调用、可对比的摘要时,常见难点是来源格式不同、反爬限制、YouTube 文字稿获取不稳定,以及输出长度难以统一。Summarize-1.0 把这些入口收敛到同一个 CLI:用模型生成摘要,并用 --json 给出机器可读结果,适合接入脚本、索引流程或知识管理管线。

技能如何工作

  • 输入源:支持 URL、本地文件和 YouTube 链接,适合从分散资料快速抽取要点。
  • 模型接入:可按 provider 设置 OPENAI_API_KEY、ANTHROPIC_API_KEY、XAI_API_KEY 或 GEMINI_API_KEY;默认使用 google/gemini-3-flash-preview。
  • 长度控制:通过 --length short|medium|long|xl|xxl 与 --max-output-tokens 控制摘要粒度。
  • 提取与回退:--extract-only 只处理 URL 内容;--firecrawl auto|off|always 可在被限制站点上启用 FIRECRAWL_API_KEY 回退;--youtube auto 在配置 APIFY_API_TOKEN 时启用 Apify 回退。
  • 输出形态:--json 便于下游解析、入库或批量对比。

边界与注意点

该技能的核心是“摘要生成”而不是完整爬虫或长期记忆系统。面对高度动态、登录态、付费墙内容时,仍依赖外部提取服务;YouTube 回退取决于 token 与第三方服务可用性。若只保留摘要原文,建议同时保存来源 URL、抓取时间和本地文件路径,方便后续复核。

使用场景

  • 把竞品官网、技术博客和本地文档快速摘成同长度要点,用于周会材料。
  • 在脚本里批量处理本地 Markdown 和网页链接,输出 JSON 供检索库使用。
  • 为 YouTube 技术教程生成摘要,并保留来源链接以便团队复核。
  • 用 --length 不同参数对比同一网页摘要粒度,挑选适合入库的版本。

适合人员

  • 负责竞品调研、需要把网页和文档压成统一要点的分析师
  • 维护文档索引、希望把本地 Markdown 转成 JSON 摘要的工程师
  • 整理技术教程、需要 YouTube 摘要与来源链接的编辑
  • 构建知识管理流水线、需要统一 URL 摘要输出的工程师