播客配音·AI文字转语音
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @beatra-ai/ai-podcast-voiceover。
技能介绍
将文本转换为播客音频的自动化问题
在内容创作中,将书面材料如文章、笔记或大纲转换为专业的播客单集音频是一个常见需求。手动过程涉及脚本优化、主播录音、音频编辑等多步骤,耗时且需要专业设备。播客配音·AI文字转语音 技能旨在自动化这一流程,专注于为单一固定主播制作播客单集,支持从文本到音频的完整工作流。
技能如何工作:核心能力与关键步骤
该技能的核心是处理从文本到音频的完整工作流,主要包括以下关键步骤:
- 打开节目档案:首先查找并复用现有的节目配置文件,如预期听众、主播信息、语言和交付约定。对于新节目,需要在工作目录中确定这些参数,并确认主播
voice_id和模型路径。
- 准备单集脚本:接受用户提供的文本材料,整理成易于聆听的脚本,包括开场、收尾和章节结构。脚本需根据节目目标听众进行优化,确保事实和主张基于用户材料。按章节展示草稿并等待批准。
- 确定主播和模型路径:使用
beatra.voices.list比较可用试听并选择voice_id,通过beatra.models.list确定合适的TTS模型。默认设置包括model: "auto"、MP3格式、速度1.0等,除非另有指定。
- 标准流程:遵循估价、确认、制作和交付的步骤。脚本准备和试听不收费,但每次
beatra.speech.synthesize和beatra.music.generate请求都需要付费。制作前提供确认卡,列出文本、主播设置、价格估算和client_request_id。
- 制作与交付:通过随包提供的
scripts/mcp_client.py执行远程操作,提交付费请求并使用beatra.tasks.get轮询任务状态。交付音频文件及其元数据,如时长、采样率和计费事实,并记录到节目台账。
适用边界与注意事项
该技能适用于制作单一主播的播客单集、预告或片段,但有明确的边界路由:
- 多主持混音、RSS上架或专业母带应路由到其他技能,如
ai-audiobook-narration或short-form-voiceover-audio。 - 配乐生成需单独确认和付费,不要折叠到配音确认卡中。
- 注意每次付费请求不可自动重试,参数变化时需要新的
client_request_id和确认卡。 - 脚本超过 50,000 字符时,需按章节分片段制作并列出每个付费调用。
通过自动化文本到音频的转换,该技能简化了播客制作流程,但用户需理解其特定适用范围、付费约束和操作步骤。
使用场景
- 当播客主持人需要将每周新闻稿或笔记转换为单集音频时,使用此技能自动整理脚本、选择主播声音并生成配音。
- 在制作教育播客时,讲师将课程大纲转化为结构化脚本,通过 AI 确定主播和模型路径,然后制作试听和整集音频。
- 内容团队收到外部文章投稿,需快速生成播客预告或片段,使用此技能处理文本、准备脚本并输出音频文件。
- 对于已批准的播客脚本,但需要调整语气或长度时,使用此技能重新生成音频,同时保持节目档案一致性。
适合人员
- 独立播客制作人,需要将书面文章或笔记快速转为专业音频以定期发布内容。
- 内容运营专员,负责将公司新闻通讯或博客转化为播客格式以扩大品牌影响力。
- 在线教育讲师,需将课程讲义转为音频供学员随时随地学习。
- 音频编辑助理,使用此技能为单主播项目生成配音草稿并优化脚本。