NewsNow 多源新闻聚合
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_52a8819e/newsnow-v2。
技能介绍
解决的问题
很多脚本需要同时读取科技、财经、社区和综合新闻,但单个 RSS 或网页源不稳定,格式不一致,串行抓取也慢,一个源超时会拖垮整体任务。
技能如何工作
该技能围绕 NewsNow 的 39 个新闻源提供聚合能力,重点把抓取变成可控的批量任务:
- 并发请求:使用
ThreadPoolExecutor并行拉取多个源,max_workers=6,减少整体等待时间。 - 超时处理:默认单源约
12 秒超时,失败源不阻塞其他源,便于继续组装可用数据。 - 缓存支持:服务端缓存约
30 分钟,降低重复请求对上游的压力。 - 依赖简单:仅依赖 Python 标准库,适配
Python 3.8+。
使用时通常先选择源 ID,如 github、juejin、hackernews、wallstreetcn,再通过 Python API 获取结构化新闻列表,适合做日报摘要、选题监控、内容去重等。
适用边界
该技能侧重“源聚合与抓取”,不是新闻解析质量评分工具,也不保证每个源长期可用。文档中标注 linuxdo、kuaishou、xiaohongshu 等源已验证不可用;调用方需要自行做字段清洗、去重、限频和异常兜底。
使用场景
- 构建科技日报时,用该技能并发拉取 GitHub、掘金、Hacker News 等源并汇总候选条目。
- 做财经选题监控时,定时请求华尔街见闻、金十数据、财联社等源,筛选当日重要快讯。
- 写内容去重脚本前,用 Python API 并发抓取知乎、微博、B站等源,拿到原始标题和链接。
- 搭建聚合看板时,利用 30 分钟缓存减少重复请求,并把多源新闻按分类展示给编辑。
适合人员
- 技术编辑:需要每天把 GitHub、掘金、Hacker News 候选条目标题汇总成日报素材。
- 财经运营:需要定时抓取华尔街见闻、金十数据、财联社快讯,筛选当日重要信息。
- 爬虫工程师:需要基于 Python API 并发多源请求,并验证单源超时不影响整体任务。
- 数据分析师:需要用 30 分钟缓存降低重复请求,把多源新闻整理成分类数据集。