全自动视频制作工具
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @user_8e115e0a/video-auto-creator1。
技能介绍
要解决的问题
从视频 URL 做二次创作时,常见瓶颈不在剪辑,而在把素材拆成可复用的结构化中间产物:标题、描述、标签、关键画面、脚本、配音、字幕和时间轴往往散落在一堆手动操作里。video-auto-creator 面向这个流程,把“读取视频 → 采样截图 → 生成脚本 → TTS 配音 → 字幕对齐 → 合成输出”串成一条可调试的流水线,适合制作宣传短片、内容摘要、演示视频或教学讲解素材。
如何工作
- 视频分析:打开 B 站、YouTube、抖音等平台页面,提取元数据并保存为 JSON,作为后续场景规划输入。
- 截图采样:按
--interval或数量截取稳定帧,用于识别关键场景和生成视觉素材。 - 脚本生成:输出场景描述、镜头文案、配音文本、字幕文本,并可生成
Midjourney/Stable Diffusion风格提示词。 - 配音与字幕:使用
edge-tts生成多语言语音,产出SRT字幕并按语音时长对齐。 - 合成输出:通过
FFmpeg将图片序列、音频和字幕合成 H.264/AAC 视频,支持 720p/1080p。
注意它依赖浏览器控制、edge-tts 与 FFmpeg,在 Windows 上还要处理编码和中文路径问题;对版权、平台抓取限制和 TTS 声音授权需自行确认。适合半自动制作,不建议直接用于未审核内容的批量分发。
使用场景
- 运营拿到 B 站产品讲解视频,需生成 60 秒宣传短片、配音和字幕。
- 内容编辑要把 YouTube 教程拆成场景脚本,并导出 SRT 字幕和配音。
- 视频实习生需批量截取抖音关键帧,按间隔生成素材帧并命名保存。
- 工程师想调试 FFmpeg 合成参数,把图片、edge-tts 音频和字幕合成 MP4。
适合人员
- 负责产品宣传短视频的运营,需要把已有 B 站视频快速改成带配音和字幕的短片。
- 制作教程内容的创作者,需要提取 YouTube 视频结构并生成场景脚本与 SRT。
- 处理社媒素材的视频实习生,需要按间隔截取关键帧并整理成可编辑素材。
- 维护自动化媒体流水线的工程师,需要串联 TTS、字幕和 FFmpeg 合成参数。