百度热搜榜 TOP 10
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_512254e3/top-baidu-hot。
技能介绍
解决什么问题
百度热搜页面通常带有日期、滚动位、弹窗和动态渲染,简单抓取容易拿到旧榜、重复条目或不足 10 条。对于只想获得「今天热门标题」的工程师,关键不是打开页面,而是判断数据是否新鲜、能否稳定输出结构化 TOP 10。
技能如何工作
该技能按「低成本抓取优先,必要时降级浏览器」的方式执行:
- 能力检测:先判断当前环境是否支持
browser,决定可用链路。 web_fetch优先:先用轻量抓取读取页面,节省浏览器资源。- 日期验证:从页面标题或内容中提取日期,并与当前
YYYY-MM-DD对比,过期数据不直接输出。 - 智能降级:当
web_fetch返回空、失败或日期异常时,切换到浏览器链路重新获取。 - 质量过滤:提取排名和标题,过滤无关内容,检查重复与数量不足。
适用边界
它适合把百度热搜作为数据源写入日志、推送、报表或下游分析,但输出仍依赖源页面结构。若页面改版、反爬加强或设备无法访问,技能会提示失败或仅保存可获取数量;它不负责语义摘要、情感分析或跨平台热度对比。
使用场景
- 做舆情日报的分析师,每天需要把百度热搜 TOP 10 标题落到当日舆情底稿。
- 做数据管道的工程师,需要把热搜标题转为 JSON 条目并校验是否为当天数据。
- 做公众号选题的编辑,早晨要快速查看百度热搜并挑选可跟进的公共话题。
- 做监控告警的运维,需要在页面旧榜时触发降级抓取,避免把过期热搜写进报表。
适合人员
- 舆情分析师:需要每日获取当天百度热搜 TOP 10,用于话题底稿与后续分析。
- 数据工程师:需要把热搜标题结构化为可校验条目,并处理抓取失败或旧数据。
- 内容编辑:需要快速浏览今日热搜,筛选值得跟进的公共话题。
- 自动化运维:需要在浏览器不可用时仍能获得当天热搜或明确失败。