网页文件摘要 CLI
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_dd0cd521/cn20260415。
技能介绍
解决的问题
当需要把网页、本地文件或 YouTube 内容压缩成可入库、可调用、可对比的摘要时,常见难点是来源格式不同、反爬限制、YouTube 文字稿获取不稳定,以及输出长度难以统一。Summarize-1.0 把这些入口收敛到同一个 CLI:用模型生成摘要,并用 --json 给出机器可读结果,适合接入脚本、索引流程或知识管理管线。
技能如何工作
- 输入源:支持 URL、本地文件和 YouTube 链接,适合从分散资料快速抽取要点。
- 模型接入:可按 provider 设置
OPENAI_API_KEY、ANTHROPIC_API_KEY、XAI_API_KEY或GEMINI_API_KEY;默认使用google/gemini-3-flash-preview。 - 长度控制:通过
--length short|medium|long|xl|xxl与--max-output-tokens控制摘要粒度。 - 提取与回退:
--extract-only只处理 URL 内容;--firecrawl auto|off|always可在被限制站点上启用FIRECRAWL_API_KEY回退;--youtube auto在配置APIFY_API_TOKEN时启用 Apify 回退。 - 输出形态:
--json便于下游解析、入库或批量对比。
边界与注意点
该技能的核心是“摘要生成”而不是完整爬虫或长期记忆系统。面对高度动态、登录态、付费墙内容时,仍依赖外部提取服务;YouTube 回退取决于 token 与第三方服务可用性。若只保留摘要原文,建议同时保存来源 URL、抓取时间和本地文件路径,方便后续复核。
使用场景
- 把竞品官网、技术博客和本地文档快速摘成同长度要点,用于周会材料。
- 在脚本里批量处理本地 Markdown 和网页链接,输出 JSON 供检索库使用。
- 为 YouTube 技术教程生成摘要,并保留来源链接以便团队复核。
- 用 --length 不同参数对比同一网页摘要粒度,挑选适合入库的版本。
适合人员
- 负责竞品调研、需要把网页和文档压成统一要点的分析师
- 维护文档索引、希望把本地 Markdown 转成 JSON 摘要的工程师
- 整理技术教程、需要 YouTube 摘要与来源链接的编辑
- 构建知识管理流水线、需要统一 URL 摘要输出的工程师