Agent Skills
返回列表
口播种草视频制作

口播种草视频制作

内容创作 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @beatra-ai/oral-seeding-video-maker。

技能介绍

要解决的问题

当内容创作者需要制作口播推荐视频,但手头没有产品图、拍摄素材或录制人声时,传统工作流依赖外部输入,效率低下且成本不可控。本技能直接针对这一痛点,允许仅从一个主题(如要推广的产品、服务或话题)出发,在零素材条件下自动完成从脚本到成片的全流程。创作者无需上传任何文件,即可获得一条竖屏口播视频,适合快速试产或资源受限的场景。

工作原理与关键步骤

本技能通过模块化步骤将主题转化为最终视频,核心能力围绕自动化生成与可控确认展开:

  1. 脚本结构选择:基于主题,从预定义的六种脚本结构中选一种,决定视频分段(如钩子、证据、行动号召)和每段功能。这一步是免费的,为后续生成奠定基础。
  2. 分镜表生成:创建详细分镜表,包含精确到秒的起止点,并拆分为两个独立字段:画面上的视觉内容(visual)和口播文案(audio)。文案需符合口播写法,确保前3秒为钩子。
  3. 素材生成与合成

- 使用 beatra.images.generate 生成分镜图像,首帧将用于后续动画,其他分镜作为静帧交付。
- 通过 beatra.speech.synthesize 合成口播音轨,音色基于短视频社交内容预设,自动适配12秒目标时长。
- 可选调用 beatra.music.generate 添加背景音乐,作为独立音轨交付。

  1. 视频动画化:在用户批准后,调用 beatra.videos.animate,以首帧为起点,结合口播音频生成竖屏视频。模型需明确指定,因为部分模型不支持外部音轨。
  2. 交付与复核:输出包括分镜图、口播音轨、垫乐及其时长、最终视频及任务ID。需检查分镜图与口播匹配、成片时长合规,并只报告任务返回的真实数据。

整个流程强调付费确认:分镜图、口播和视频生成前均需用户批准,避免意外费用。视频生成前还需验证余额,确保足够支付。

适用边界与注意事项

本技能适用于零素材的口播推荐视频,典型场景是快速生成竖屏短片(默认12秒,上限15秒)。边界与注意点包括:

  • 时长与模型限制:成片必须落在所选实时模型支持的范围内,超时或模型不兼容将导致失败。视频动画仅基于首帧,其他分镜需用户自行剪辑。
  • 素材依赖:当已有产品图、人声或参考片时,应使用产品视频、配音或拆片重制等其他工作流。数字人口播工作流适合需要真人或数字人出现的场景。
  • 付费与恢复:每次付费调用需生成稳定的 client_request_id,并只提交一次。任务失败时(如 insufficient_balance),需用户充值后用原载荷重试。
  • 自动更新:技能包支持静默自动更新,但更新失败不影响当前任务,绝不会因此重试付费生成。

总之,本技能在脚本结构分镜表驱动下,实现从主题到视频的闭环,但需严格遵循确认步骤以控制成本和质量。

使用场景

  • 当社交媒体运营需要为新产品发布制作一条12秒的口播种草视频,但没有任何产品实拍图或录制好的推广话术时,使用本技能从产品主题出发,自动生成脚本、分镜、配音和动画。
  • 当个人创作者想在短视频平台推荐一款小众App,但缺乏剪辑素材和口播经验时,通过输入App名称和功能点,获得一条完整的竖屏口播视频,可直接发布。
  • 当市场团队在测试不同营销话术效果时,需要快速产出多条相似主题但脚本结构不同的口播视频,用于A/B测试,本技能可批量从主题生成带差异的分镜和成片。
  • 当教育类博主想分享一个知识概念,但不露脸且无复杂动画素材时,用本技能将主题转化为条理清晰的口播讲解视频,节省传统剪辑和配音时间。

适合人员

  • 电商运营:每周需为不同SKU制作多条竖屏种草视频,但摄影团队排期紧张,希望零素材快速出片。
  • 短视频MCN编辑:负责多个账号内容,经常需要根据热点主题即时生成口播视频,以抓住流量窗口期。
  • 市场部产品经理:在推广新产品时,需要快速制作演示视频用于内部评审或初步用户测试,但尚未制作正式宣传物料。
  • 独立知识博主:以口播形式分享专业见解,但不露脸、无拍摄条件,需要工具将文字大纲转化为视频。