Agent Skills
返回列表
哼唱成曲

哼唱成曲

设计多媒体 更新于 2026.08.30

将以下提示词粘贴到你的 AI 对话框中:

请根据 https://skillhub.cn/install/skillhub.md,安装 @user_15292d5a/yjkj-hum2song 到我的 AI 助手中。

技能介绍

解决的问题

当你只有一段哼唱、清唱或临时录音,想把它整理成可继续制作的 MIDI 旋律,甚至生成完整歌曲时,传统方式往往要上传音频到云端。hum2song 更适合本地工作流:它把 WAV、MP3、M4A、FLAC、OGG 等音频转成 44.1kHz 单声道,再提取旋律,避免录音外传。

技能如何工作

  • 旋律提取:使用 Spotify 的 Basic Pitch 将哼唱或演唱转换为 MIDI,支持 C1 到 C8 音域、多音检测和约 10ms 时序分辨率。
  • MIDI 清洗:对提取出的音符进行清理和结构化,减少误检与节奏噪声。
  • 生成完整歌曲:如果已手动安装 ACE-Step,可选用本地模型生成音频;如果没有 AI 模型,也可以使用 MIDI + SoundFont 合成器路线。
  • 输出选项:支持 pop、rock、jazz、classical、electronic 风格,以及 upbeat、calm、energetic、melancholic 情绪,时长可在 30 到 300 秒之间。

适用边界

该技能需要本地 Python 环境。ACE-Step 是可选依赖,基础模型约需 4GB RAM,启用时可能需要在本地下约 4GB 权重;一段两分钟歌曲的处理时间可能在 2 到 5 分钟。生成质量取决于哼唱清晰度,复杂和声不一定能被完整捕获。

使用场景

  • 把手机里一段清唱旋律转成可编辑 MIDI,再交给 DAW 做编曲。
  • 在离线环境中将哼唱录音提取为 MIDI,避免上传含人声素材到云端。
  • 用 MIDI + SoundFont 路线生成一段演示音频,不想安装 ACE-Step。
  • 将一段两分钟哼唱生成 30 到 300 秒的完整歌曲素材并输出 WAV。

适合人员

  • 想把临时哼唱整理成可编辑 MIDI 的独立音乐人。
  • 需要在本地处理录音、不上传敏感音频的播客或音频创作者。
  • 想测试旋律 demo 但不想配置云端 API 的游戏音频策划。
  • 需要把清唱素材转 MIDI 再进 DAW 编曲的编曲工程师。