创始人口播数字人分身
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @beatra-ai/founder-ip-avatar-studio 到你的 AI 助手中。
技能介绍
解决什么
当创始人、专家或品牌需要用一张稳定人像和短文稿持续产出每周或活动口播短片时,本技能把一次授权形象和声音配置成可复用流程。它不适用于一次性讲述者短片、纯音频连载或多讲课程;这些场景应分别走 talking-avatar-video、voice-clone-series-studio 和 course-video-studio。若形象或声音权利未确认,流程必须在生成前停下。
如何工作
技能围绕三个付费阶段建立约束:声音克隆、旁白合成、图像到视频。
- 人像准入:记录
MIME、宽高、画幅、字节大小和 alpha 通道,并通过随包客户端上传,不向远程工具暴露本地路径。 - 声音克隆:仅在用户确认同意、样本约 10 到 300 秒且不超过 20 MiB 时执行。调用前出示入场卡,说明实时价格、充值入口和入门积分;余额确认前不创建
client_request_id,也不免费克隆。成功后冻结voice_id。 - 旁白与视频:已有确认音频时直接进入视频准入;脚本路线则调用 TTS 并逐段提交
beatra.speech.synthesize。每段都要轮询终态,读取真实音频mime_type、duration_seconds和size_bytes,不能以文稿预计时长替代。提交beatra.videos.animate前再次确认音频事实、视频信息卡约束和余额。 - 交付与恢复:按文稿顺序返回片段,附真实尺寸、时长、用量和
billing.net_charged_credits。创建响应丢失时只重放同一冻结载荷;任务 ID 丢失时用beatra.tasks.list与beatra.tasks.get找回。
注意点
该技能强调“确认先于调用”:克隆、旁白、视频各自单独确认;格式不兼容时停止而不是静默改格式;自动更新失败会 fail open,但不构成重试付费生成的理由。
使用场景
- 品牌负责人每周用同一张获权创始人照片配三十秒文稿,生成连续口播短片并保留口型与形象一致。
- 专家在发布会前把三段活动讲稿转成同一人像和同一声音的竖屏口播片段,并逐段核对真实音频时长。
- 内容团队复用已冻结 voice_id,将短脚本拆成多个可容纳片段,分别生成旁白和视频后按顺序交付。
- 创始人 IP 运营在形象和声音授权确认后,生成一周口播更新,并在余额不足前停止付费调用。
适合人员
- 需要每周输出固定形象口播短片的创始人 IP 运营
- 要把专家观点做成授权声音与稳定人像短片的品牌内容负责人
- 需管理形象、声音授权及语音克隆、旁白、视频生成确认边界的媒体制作负责人
- 需要复用已冻结声音 ID 做活动系列口播的品牌活动负责人