Agent Skills
返回列表
MiniMax 音乐与歌词生成

MiniMax 音乐与歌词生成

设计多媒体 更新于 2026.08.29

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_c9d52b8e/minimax-music-v2。

技能介绍

解决什么问题

很多工程化场景需要先把描述转化为歌词,再把歌词或纯音乐描述转成可播放音频。直接调用 MiniMax Music Generation API 时,容易遇到参数组合、模型可用性、音频格式、本地播放依赖和不同 Plan 权限边界等问题。这个技能把常见调用路径整理为歌词生成和音乐生成两类命令,减少手动拼装请求的成本。

工作方式

核心能力包括:

  • 歌词生成:通过 prompt 描述主题,可用 --mode 选择 write_full_song、write_lyrics_only 或 optimize_lyrics,分别面向完整歌曲、仅歌词和已有歌词优化。歌词中可加入段落标签,例如 [Intro]、[Verse]、[Chorus]、[Bridge],用于表达歌曲结构。
  • 音乐生成:输入风格、情绪、场景描述,可附带 --lyrics;支持 --instrumental 生成无人声纯音乐,并可通过 --format、--bitrate、--sample-rate 控制输出。
  • 结果处理:默认写入 minimax-music-output/,也可用 --output 指定路径;歌词默认打印到屏幕,指定输出路径后保存为文件;--play 可在生成后本地播放。

使用边界

需要注意:Music Generation API 需要独立音乐 Plan,Lyrics Generation API 可用 Coding Plan Key;已验证可用模型为 music-2.6。API Key 可保存在 config.json 或环境变量 MINIMAX_API_KEY。pyglet 主要用于播放 mp3/wav,只做歌词生成时通常不需要实际播放链路。

使用场景

  • 为短视频脚本先写出可演唱的完整歌词,再用同一描述生成伴奏 Demo。
  • 把一段已有歌词按 [Verse]、[Chorus] 结构优化,再生成 256kbps MP3。
  • 为演示原型生成无人声氛围背景乐,导出 WAV 后在本地快速试听。
  • 在创意评审前,用风格描述快速产出 music-2.6 候选旋律和歌词版本。

适合人员

  • 需要把创意文案快速变成歌词和旋律 Demo 的短视频编导。
  • 要给产品原型配置可试听氛围背景乐的前端或产品经理。
  • 正在封装 MiniMax 音频接口、需要稳定歌词生成参数的后端工程师。
  • 要为游戏活动产出纯音乐片段并本地校验格式的技术策划。