Agent Skills
返回列表
全自动视频制作工具

全自动视频制作工具

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_8e115e0a/video-auto-creator1。

技能介绍

要解决的问题

从视频 URL 做二次创作时,常见瓶颈不在剪辑,而在把素材拆成可复用的结构化中间产物:标题、描述、标签、关键画面、脚本、配音、字幕和时间轴往往散落在一堆手动操作里。video-auto-creator 面向这个流程,把“读取视频 → 采样截图 → 生成脚本 → TTS 配音 → 字幕对齐 → 合成输出”串成一条可调试的流水线,适合制作宣传短片、内容摘要、演示视频或教学讲解素材。

如何工作

  • 视频分析:打开 B 站、YouTube、抖音等平台页面,提取元数据并保存为 JSON,作为后续场景规划输入。
  • 截图采样:按 --interval 或数量截取稳定帧,用于识别关键场景和生成视觉素材。
  • 脚本生成:输出场景描述、镜头文案、配音文本、字幕文本,并可生成 Midjourney / Stable Diffusion 风格提示词。
  • 配音与字幕:使用 edge-tts 生成多语言语音,产出 SRT 字幕并按语音时长对齐。
  • 合成输出:通过 FFmpeg 将图片序列、音频和字幕合成 H.264/AAC 视频,支持 720p/1080p。

注意它依赖浏览器控制、edge-tts 与 FFmpeg,在 Windows 上还要处理编码和中文路径问题;对版权、平台抓取限制和 TTS 声音授权需自行确认。适合半自动制作,不建议直接用于未审核内容的批量分发。

使用场景

  • 运营拿到 B 站产品讲解视频,需生成 60 秒宣传短片、配音和字幕。
  • 内容编辑要把 YouTube 教程拆成场景脚本,并导出 SRT 字幕和配音。
  • 视频实习生需批量截取抖音关键帧,按间隔生成素材帧并命名保存。
  • 工程师想调试 FFmpeg 合成参数,把图片、edge-tts 音频和字幕合成 MP4。

适合人员

  • 负责产品宣传短视频的运营,需要把已有 B 站视频快速改成带配音和字幕的短片。
  • 制作教程内容的创作者,需要提取 YouTube 视频结构并生成场景脚本与 SRT。
  • 处理社媒素材的视频实习生,需要按间隔截取关键帧并整理成可编辑素材。
  • 维护自动化媒体流水线的工程师,需要串联 TTS、字幕和 FFmpeg 合成参数。