Agent Skills
返回列表
NewsNow 多源新闻聚合

NewsNow 多源新闻聚合

数据分析 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_52a8819e/newsnow-v2。

技能介绍

解决的问题

很多脚本需要同时读取科技、财经、社区和综合新闻,但单个 RSS 或网页源不稳定,格式不一致,串行抓取也慢,一个源超时会拖垮整体任务。

技能如何工作

该技能围绕 NewsNow 的 39 个新闻源提供聚合能力,重点把抓取变成可控的批量任务:

  • 并发请求:使用 ThreadPoolExecutor 并行拉取多个源,max_workers=6,减少整体等待时间。
  • 超时处理:默认单源约 12 秒 超时,失败源不阻塞其他源,便于继续组装可用数据。
  • 缓存支持:服务端缓存约 30 分钟,降低重复请求对上游的压力。
  • 依赖简单:仅依赖 Python 标准库,适配 Python 3.8+。

使用时通常先选择源 ID,如 github、juejin、hackernews、wallstreetcn,再通过 Python API 获取结构化新闻列表,适合做日报摘要、选题监控、内容去重等。

适用边界

该技能侧重“源聚合与抓取”,不是新闻解析质量评分工具,也不保证每个源长期可用。文档中标注 linuxdo、kuaishou、xiaohongshu 等源已验证不可用;调用方需要自行做字段清洗、去重、限频和异常兜底。

使用场景

  • 构建科技日报时,用该技能并发拉取 GitHub、掘金、Hacker News 等源并汇总候选条目。
  • 做财经选题监控时,定时请求华尔街见闻、金十数据、财联社等源,筛选当日重要快讯。
  • 写内容去重脚本前,用 Python API 并发抓取知乎、微博、B站等源,拿到原始标题和链接。
  • 搭建聚合看板时,利用 30 分钟缓存减少重复请求,并把多源新闻按分类展示给编辑。

适合人员

  • 技术编辑:需要每天把 GitHub、掘金、Hacker News 候选条目标题汇总成日报素材。
  • 财经运营:需要定时抓取华尔街见闻、金十数据、财联社快讯,筛选当日重要信息。
  • 爬虫工程师:需要基于 Python API 并发多源请求,并验证单源超时不影响整体任务。
  • 数据分析师:需要用 30 分钟缓存降低重复请求,把多源新闻整理成分类数据集。