抖音爆款爬虫 V2
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-douyin-scraper-v2。
技能介绍
要解决的具体问题
做抖音内容研究时,常见需求不是“爬整站”,而是快速根据自然语言得到一批可分析的数据:搜索某个关键词下的视频,看看热榜有哪些方向,拿到播放、点赞、评论、分享等字段,后续用于选题分析或竞品观察。若每次手工写脚本或拼接接口,门槛较高,也容易把平台请求、字段整理、结果落盘混在一起。
技能如何工作
douyin-scraper-v2 把自然语言请求映射为固定脚本命令:
- 关键词搜索:从“搜索一下海鲜视频”中抽取核心词
海鲜,调用python scripts/scraper.py search --keyword "海鲜" --limit 10 - 热榜查询:对“看看抖音热榜”类请求调用
python scripts/scraper.py hot --limit 20 - 结果输出:返回
JSON数组,字段包括title、description、author、play_count、like_count、comment_count、share_count、url、tags、publish_time - 依赖降级:需要
Playwright和Chromium;若环境缺失,脚本会进入mock模式返回示例数据,便于先调试字段
这种设计适合把抖音数据作为分析输入,而不是直接做大规模抓取工具。
适用边界与注意点
该技能面向小范围查询和结构化整理,不适合绕过风控、批量下载或高频轮询。单视频链接解析目前暂不支持,遇到“分析这个链接”类请求应明确提示。使用时应遵守平台规则,控制请求频率,并将输出用于合规的内容分析场景。
使用场景
- 做账号选题时,用自然语言搜索指定关键词的视频,拿到播放、点赞、评论等字段做方向判断。
- 复盘热门内容前,查询抖音热榜 top20,整理标题、作者、播放量,形成观察清单。
- 搭建内容分析流程时,把自然语言请求转成搜索命令,输出统一 JSON 字段供后续聚合。
- 排查选题空白时,围绕行业关键词搜索视频,比较点赞、评论、分享等互动数据。
适合人员
- 负责短视频选题的内容编辑:需要按关键词快速收集视频标题与互动数据。
- 做竞品观察的增长分析师:需要把热榜和关键词结果整理成可聚合字段。
- 写数据分析脚本的工程师:需要把自然语言意图落到稳定的搜索或热榜命令。
- 运营账号的数据助理:需要保存搜索与热榜 JSON 结果用于复盘。