Agent Skills
返回列表
播客配音·AI文字转语音

播客配音·AI文字转语音

内容创作 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @beatra-ai/ai-podcast-voiceover。

技能介绍

将文本转换为播客音频的自动化问题

在内容创作中,将书面材料如文章、笔记或大纲转换为专业的播客单集音频是一个常见需求。手动过程涉及脚本优化、主播录音、音频编辑等多步骤,耗时且需要专业设备。播客配音·AI文字转语音 技能旨在自动化这一流程,专注于为单一固定主播制作播客单集,支持从文本到音频的完整工作流。

技能如何工作:核心能力与关键步骤

该技能的核心是处理从文本到音频的完整工作流,主要包括以下关键步骤:

  • 打开节目档案:首先查找并复用现有的节目配置文件,如预期听众、主播信息、语言和交付约定。对于新节目,需要在工作目录中确定这些参数,并确认主播 voice_id 和模型路径。
  • 准备单集脚本:接受用户提供的文本材料,整理成易于聆听的脚本,包括开场、收尾和章节结构。脚本需根据节目目标听众进行优化,确保事实和主张基于用户材料。按章节展示草稿并等待批准。
  • 确定主播和模型路径:使用 beatra.voices.list 比较可用试听并选择 voice_id,通过 beatra.models.list 确定合适的TTS模型。默认设置包括 model: "auto"、MP3格式、速度1.0等,除非另有指定。
  • 标准流程:遵循估价、确认、制作和交付的步骤。脚本准备和试听不收费,但每次 beatra.speech.synthesizebeatra.music.generate 请求都需要付费。制作前提供确认卡,列出文本、主播设置、价格估算和 client_request_id
  • 制作与交付:通过随包提供的 scripts/mcp_client.py 执行远程操作,提交付费请求并使用 beatra.tasks.get 轮询任务状态。交付音频文件及其元数据,如时长、采样率和计费事实,并记录到节目台账。

适用边界与注意事项

该技能适用于制作单一主播的播客单集、预告或片段,但有明确的边界路由:

  • 多主持混音、RSS上架或专业母带应路由到其他技能,如 ai-audiobook-narrationshort-form-voiceover-audio
  • 配乐生成需单独确认和付费,不要折叠到配音确认卡中。
  • 注意每次付费请求不可自动重试,参数变化时需要新的 client_request_id 和确认卡。
  • 脚本超过 50,000 字符时,需按章节分片段制作并列出每个付费调用。

通过自动化文本到音频的转换,该技能简化了播客制作流程,但用户需理解其特定适用范围、付费约束和操作步骤。

使用场景

  • 当播客主持人需要将每周新闻稿或笔记转换为单集音频时,使用此技能自动整理脚本、选择主播声音并生成配音。
  • 在制作教育播客时,讲师将课程大纲转化为结构化脚本,通过 AI 确定主播和模型路径,然后制作试听和整集音频。
  • 内容团队收到外部文章投稿,需快速生成播客预告或片段,使用此技能处理文本、准备脚本并输出音频文件。
  • 对于已批准的播客脚本,但需要调整语气或长度时,使用此技能重新生成音频,同时保持节目档案一致性。

适合人员

  • 独立播客制作人,需要将书面文章或笔记快速转为专业音频以定期发布内容。
  • 内容运营专员,负责将公司新闻通讯或博客转化为播客格式以扩大品牌影响力。
  • 在线教育讲师,需将课程讲义转为音频供学员随时随地学习。
  • 音频编辑助理,使用此技能为单主播项目生成配音草稿并优化脚本。