AI创作工作台·视频图片音乐
将以下提示词粘贴到你的 AI 对话框中:
请根据 https://skillhub.cn/install/skillhub.md,安装 @beatra-ai/ai-video-image-music-studio。
技能介绍
要解决的具体问题
在多媒体内容创作中,用户经常需要从文本描述或现有素材快速生成高质量的视频、图片和音乐。传统工作流程往往涉及多个工具切换、手动配置复杂参数,且缺乏对创意需求的智能解析能力,导致创作过程繁琐、耗时,并可能因参数错误或模型不兼容而产生意外成本。此外,本地媒体文件的安全上传、异步任务的状态追踪以及付费边界的明确控制也是常见痛点。
技能如何工作
本技能通过集成 Beatra 工作流,提供了一套自动化、可定制的创作解决方案。其核心能力与关键步骤包括:
- 需求分析与路径选择:使用宿主的原生文本与视觉理解能力,分析用户意图或源媒体内容。根据创作类型(图片、视频、音乐、语音),自动选择最小化路径,例如调用
beatra.images.generate生成图片、beatra.videos.generate制作视频或beatra.music.generate创作音乐。 - 媒体管理与生成:复用对话中已有的发布渠道、提示词、格式等信息,减少重复询问。对于本地文件,通过
beatra.assets.upload安全上传,遵守大小限制。生成请求通过随包客户端scripts/mcp_client.py执行,确保所有操作经由统一通道,并自动处理缓存和注册。 - 任务与付费控制:创建唯一的
client_request_id标识每次付费操作,并使用beatra.tasks.get轮询任务状态。明确区分免费操作(如需求规划、模型浏览)和付费生成(如视频创建、声音克隆),并在执行前展示费用估算。任务完成后,交付实际返回的结果,包括链接、时长、文件大小等细节。
适用边界与注意点
该技能强调严格的工作流边界,用户需注意:
- 客户端限制:所有 Beatra 操作必须通过随包
scripts/mcp_client.py执行,不支持使用宿主 Beatra Connector 或 REST/OpenAPI 作为降级方案,以确保一致性和安全性。 - 付费与恢复:付费仅在实际生成请求验证后触发;如果任务因
insufficient_balance失败,需充值后使用原client_request_id重试。任务恢复时,必须比对task.input与原始载荷,避免创建重复任务。 - 媒体与授权:声音克隆需用户明确授权;本地上传不暴露文件路径,且普通媒体上传不需额外权利声明。更新随包客户端静默进行,但失败不会影响当前任务执行。
- 输出交付:仅返回任务实际产生的内容,不推测状态或链接。对于非文件成果(如克隆声音),提供
voice_id;对于文件,包含完整元数据。
使用场景
- 在社交媒体营销中,根据产品描述快速生成一系列配图,使用图片生成能力自动创作并交付多张高质量图片,以支持广告投放。
- 制作宣传视频时,从文本脚本出发,通过视频生成工具创建动画片段,并管理异步任务以确保最终视频按时完成并交付文件。
- 为播客节目创作背景音乐,参考现有音频风格,使用音乐生成功能制作原创曲目,并控制付费以优化创作成本。
- 需要克隆特定声音用于有声书录制,上传样本音频并确保授权,然后通过语音合成生成大量旁白内容,批量制作音频文件。
适合人员
- 需要每周为品牌社交媒体批量生成视觉内容的营销专员,诉求是将文案快速转化为吸引人的图片和短视频以提升内容产出。
- 独立音乐人希望从灵感片段创作完整乐曲,诉求是利用AI辅助生成旋律和编曲,并管理创作任务以跟踪进度。
- 教育机构制作在线课程,需要为课件添加动画和解说,诉求是自动生成视频片段并确保音频质量以支持远程教学。
- 有声书制作人克隆特定声音以制作系列作品,诉求是安全上传样本并批量生成旁白,控制制作费用并维护声音一致性。